Simon Willison 用 pelican 基准实测 Claude Fable 5.1 的五个推理档位

💡 灵机 AI 深度洞见与核心提炼
Simon Willison 实测 Claude Fable 5.1 在 pelican 基准上的表现。Anthropic 称该模型在 Terminal-Bench-Science 0.1 上得 52.6%,高于 Fable 5 的 24.7%。
信源媒体:Simon Willison 博客
访问出处网页 ↗