Google 发布 RRSI 框架,围绕冻结模型自动进化 LLM Agent harness
💡 灵机 AI 深度洞见与核心提炼
Google 发布 Regularized Recursive Self-Improvement of Agent Harnesses(RRSI),一个自动进化 LLM agent harness 的框架。RRSI 在冻结 LLM 周围自动演进 harness 的全部 prompt、控制流、工具和记忆组件。论文指出对固定演进集进化 harness 虽有效但会过拟合,分布内的大幅收益在分布外会缩水或消失,RRSI 通过保持编辑空间开放并对搜索轨迹加正则化来解决。项目页与论文已于 09/21/2026 发布。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗