AI圈报
模型发布 / 更新精选

Inception Labs 发布 Mercury 2:首个在 NVIDIA GPU 上每秒解码超 1000 token 的推理扩散语言模型

信息来源:Inception Labs:Blog(网页)·
原始标题:Mercury 2: the first reasoning model fast enough to pick up the phone

内容摘要

Inception Labs 发布 Mercury 2,称其为全球首个推理扩散语言模型(dLLM),在 NVIDIA H100 上以 1000+ token/秒并行解码,300 token 的推理链可在约 300ms 内完成,适配语音对话延迟预算。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Inception Labs:Blog(网页)
站内情报编号intel-23192268f2925d75744707ca