Salesforce 论文提出在策略修正,解决 harness 与模型协同进化中的模仿失效问题
💡 灵机 AI 深度洞见与核心提炼
Salesforce AI 发布论文《Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails》。
信源媒体:X:Elvis Saravia (@omarsar0, DAIR.AI)
访问出处网页 ↗