模型发布 / 更新普通
Muse Voice Transcribe is MSL's first real-time audio perception model -- rolling out today. SOTA in …
内容摘要
Mark Zuckerberg 宣布 Muse Voice Transcribe 于当日推出,是 MSL 的首个实时音频感知模型。该模型在流式语音转文字上达到 SOTA,并在单一模型内原生支持说话人分离(speaker diarization)和端点检测(endpointing)。
内容分类AI 模型发布与更新
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Mark Zuckerberg (@finkd)
站内情报编号intel-185cddc28b61694cf07539cb