Databricks 推理 GLM-5.3 达 310 tok/s,速度与延迟均居第一
💡 灵机 AI 深度洞见与核心提炼
Yuchen Jin 转发评测图称 Databricks 上 GLM-5.3 输出速度达 310 tok/s,端到端响应 8.9 秒,在多家 API 提供方中速度与延迟均排第一。他还称在 Databricks 内部编码基准上,GLM-5.3 是编码最强的开源权重模型,可与 Fable 5 和 Opus 4.8 竞争。
信源媒体:X:Yuchen Jin (@Yuchenj_UW)
访问出处网页 ↗