信源:X:腾讯混元 (@TencentHunyuan) · 👁️ 41924 次研读

腾讯混元如何把 770B 参数模型压进 214 GiB

💡 灵机 AI 深度洞见与核心提炼
腾讯混元量化团队将 Hy4 preview 的权重从约 1.5TB 压缩到 214 GiB,参数量仍保持 770B,仅改变权重表示方式。其 Sherry 算法与 STQ1_0 格式让每组四个权重仅需 5 bit,混合精度模型平均约 2.38 bit/权重。
信源媒体:X:腾讯混元 (@TencentHunyuan)
访问出处网页 ↗
阅读原文出处 ↗