亚马逊论文:LLM 可当研究世界模型预测实验结果
💡 灵机 AI 深度洞见与核心提炼
亚马逊新论文提出用 LLM 充当"研究世界模型",在实验开跑前预测训练改动的收益。基于 9 个设置、2653 条真实实验记录测试,同设置历史记录将预测与实际结果的平均排名相关性从 0.506 提升至 0.774(5 个设置);在 OLMo3-100M 上,低推理强度加记录得 0.892,最高推理强度无记录仅 0.648。作者建议研究智能体记录包括失败在内的每次实验,并喂给选下次运行的模型。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗