论文 信源:X:Rohan Paul (@rohanpaul_ai) · 👁️ 16569 次研读

Johns Hopkins 与 CMU 论文:小模型可从运行结果学会改进 Agent 的 harness 代码并迁移到新任务

💡 灵机 AI 深度洞见与核心提炼
Johns Hopkins 与 CMU 的论文提出 harness learning,训练一个小模型根据失败报告改写 Agent 的 harness 代码(即决定模型看到什么、调用哪些工具的部分),以新 harness 的得分作为奖励。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗
阅读原文出处 ↗