slop code bench 汇总 Fable 5.1、Sol 与 GLM 5.3 不同推理档位的编码评测结果
💡 灵机 AI 深度洞见与核心提炼
Dex Horthy 发文称 slop code bench 正在成形,对比 Fable 5.1、Sol 的 med/high/xhigh 档位以及 GLM 5.3 的 med/high 档位。他表示许多 run 尚未完成,会持续更新,并感谢 GOrlanski 团队搭建该基准。
信源媒体:X:Dex Horthy(HumanLayer)(@dexhorthy)
访问出处网页 ↗