技巧 信源:Hacker News:AI 热帖 · 👁️ 44474 次研读

The AI Race Just Got Awkward:西方模型悄然采用 DeepSeek 的 KV cache 优化

💡 灵机 AI 深度洞见与核心提炼
作者认为西方实验室已悄然采用中国实验室公开的模型优化成果。DeepSeek 持续公开 KV cache 压缩技术,从 MLA 的约 15 倍压缩到 DeepSeek-V4.1-Flash 的 CSA2、跨层 cache 复用与 FP4 缓存,将全局 KV cache 降至每 token 890 字节,较 DeepSeek-V1 在长上下文编码场景降低约 437 倍。
信源媒体:Hacker News:AI 热帖
访问出处网页 ↗
阅读原文出处 ↗