模型发布 / 更新普通
DeepSeek V4.1 Flash 发布:KV Cache 缩小 437 倍
原始标题:https://x.com/i/article/2098194540293472256
内容摘要
DeepSeek 发布 552B 参数的 MoE 模型 V4.1 Flash,采用输入输出不对称的 Causal Encoder Decoder 结构,输入侧激活 8B、输出侧 16B,原生支持多模态视觉理解。
内容分类AI 模型发布与更新
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:洪明 (@hongming731)
站内情报编号intel-160c0d7c786b771b52269456