AI圈报
模型发布 / 更新普通

Muse Voice Transcribe is MSL's first real-time audio perception model -- rolling out today. SOTA in …

信息来源:X:Mark Zuckerberg (@finkd)·

内容摘要

Mark Zuckerberg 宣布 Muse Voice Transcribe 于当日推出,是 MSL 的首个实时音频感知模型。该模型在流式语音转文字上达到 SOTA,并在单一模型内原生支持说话人分离(speaker diarization)和端点检测(endpointing)。
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Mark Zuckerberg (@finkd)
站内情报编号intel-185cddc28b61694cf07539cb