Johns Hopkins 与 CMU 论文:小模型可从运行结果学会改进 Agent 的 harness 代码并迁移到新任务
💡 灵机 AI 深度洞见与核心提炼
Johns Hopkins 与 CMU 的论文提出 harness learning,训练一个小模型根据失败报告改写 Agent 的 harness 代码(即决定模型看到什么、调用哪些工具的部分),以新 harness 的得分作为奖励。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗