KVMEM:通过分页旧 KV 状态让百万 token 级智能体记忆变得实用
💡 灵机 AI 深度洞见与核心提炼
KVMEM 通过分页旧 KV 状态,让百万 token 级智能体记忆变得实用。在 DeepSWE 上用 Qwen3.8-27B 将 Pass@1 从 43.8% 提升至 48.4%,优于仅用压缩方案,恢复速度在受控基准上比 Compact+RAG 快 11.4-53.8×。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗