模型 信源:X:Yuchen Jin (@Yuchenj_UW) · 👁️ 42150 次研读

GLM-5.3-Flash 推理速度达 270 tok/s

💡 灵机 AI 深度洞见与核心提炼
GLM-5.3-Flash 达到 270 tok/s! Databricks 推理团队火力全开。为团队感到骄傲! 在我们 OfficeQA Pro v2 基准测试中,GLM-5.3-Flash 以仅 1/10 的成本,质量比 GLM-5.2 高出 10%。 又快、又便宜、又好。
信源媒体:X:Yuchen Jin (@Yuchenj_UW)
访问出处网页 ↗
阅读原文出处 ↗