模型 信源:X:ARC Prize (@arcprize) · 👁️ 33495 次研读

Grok 4.7 在 ARC-AGI-3 的评测成绩

💡 灵机 AI 深度洞见与核心提炼
@SpaceXAI 在 ARC-AGI-3 上,Grok 4.7 在标准测试框架中得分 1.8%(Grok 4.7 为 2.1%),该框架允许模型在轮次之间保留笔记;在新的提供商适配器框架中得分 10.0%,该框架保留不透明推理并启用自动压缩。
信源媒体:X:ARC Prize (@arcprize)
访问出处网页 ↗
阅读原文出处 ↗