模型 信源:公众号:智谱(GLM) · 👁️ 16670 次研读

智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s

💡 灵机 AI 深度洞见与核心提炼
智谱正式推出 GLM-5.3-FlashX,在 GLM-5.3-Flash 基础上加大对 Infra 侧投入与推理优化,速度最高 200 tokens/s,算力基于 10 万张国产芯片。该模型此前曾以 Ox Alpha 之名面向开发者,官方称其长期保持同尺寸最强智能水平并具备高性价比,API 已上线,Model Key:GLM-5.3-FlashX。
信源媒体:公众号:智谱(GLM)
访问出处网页 ↗
阅读原文出处 ↗