信源:X:karminski (@karminski3) · 👁️ 33564 次研读

关于 benchmark 中 reasoning_effort 该用 high 还是 max 的讨论

💡 灵机 AI 深度洞见与核心提炼
做 benchmark 不能因其他模型都用 max 就给 DeepSeek 单独用 high 测,评论则认为应该用 high 测。reasoning_effort 被指是厂商营销手段,把算力与精度权衡及计费风险转移给用户,宣称 benchmark 全用 max 跑、甜区在 high,导致有人误以为 high 最好。
信源媒体:X:karminski (@karminski3)
访问出处网页 ↗
阅读原文出处 ↗