CMU 论文提出 Harness Learning:用 RL 训练提案模型改写 harness 代码实现测试时适应
💡 灵机 AI 深度洞见与核心提炼
CMU 论文提出 harness learning,用 RL 训练一个提案模型读取任务、当前 harness 和执行报告后生成 harness 代码修改,以修改后 harness 的得分为奖励,solver 模型权重不变。
信源媒体:X:Elvis Saravia (@omarsar0, DAIR.AI)
访问出处网页 ↗