技巧 信源:X:Testing Catalog (@testingcatalog) · 👁️ 47635 次研读

Musk 称 Grok 4.7 需再推迟几天,疑因 RL 过度惩罚回复长度

💡 灵机 AI 深度洞见与核心提炼
Musk 回复称 Grok 4.7 还需几天继续打磨,可能因为在 RL 中对回复长度惩罚过重,模型仍会过早放弃其实能完成的困难任务,检查自身工作也不够严谨。TestingCatalog 补充称 9 月下半月 Meta 和 OpenAI 将在 OpenAI DevDay、Meta Connect 等活动前后发布模型,Grok 4.7 面临较高竞争门槛。
信源媒体:X:Testing Catalog (@testingcatalog)
访问出处网页 ↗
阅读原文出处 ↗