观点 / 方法普通
The AI Race Just Got Awkward:西方模型悄然采用 DeepSeek 的 KV cache 优化
原始标题:The AI Race Just Got Awkward
内容摘要
作者认为西方实验室已悄然采用中国实验室公开的模型优化成果。DeepSeek 持续公开 KV cache 压缩技术,从 MLA 的约 15 倍压缩到 DeepSeek-V4.1-Flash 的 CSA2、跨层 cache 复用与 FP4 缓存,将全局 KV cache 降至每 token 890 字节,较 DeepSeek-V1 在长上下文编码场景降低约 437 倍。