AI圈报
模型发布 / 更新普通

DeepSeek V4.1 Flash 发布:KV Cache 缩小 437 倍

信息来源:X:洪明 (@hongming731)·
原始标题:https://x.com/i/article/2098194540293472256

内容摘要

DeepSeek 发布 552B 参数的 MoE 模型 V4.1 Flash,采用输入输出不对称的 Causal Encoder Decoder 结构,输入侧激活 8B、输出侧 16B,原生支持多模态视觉理解。
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:洪明 (@hongming731)
站内情报编号intel-160c0d7c786b771b52269456