模型 信源:X:ARC Prize (@arcprize) · 👁️ 29387 次研读

Grok 4.7 推理 token 用量与 ARC-AGI-2 得分相关

💡 灵机 AI 深度洞见与核心提炼
@SpaceXAI Grok 4.7 的推理 token 用量与其 ARC-AGI-2 公开得分相关:low 档平均每次测试对尝试用 10k token,得分 25%;而 medium 到 xhigh 档用 86k 到 120k token,得分 57.5% 到 60%。low 档更低的 token 用量可能有助于解释其更低的得分。
信源媒体:X:ARC Prize (@arcprize)
访问出处网页 ↗
阅读原文出处 ↗