AI圈报
模型发布 / 更新普通

Meta 发布实时音频感知模型 Muse Voice Transcribe

信息来源:X:AI at Meta (@AIatMeta)·
原始标题:Introducing Muse Voice Transcribe, the first real-time audio perception model from Meta Superintelli…

内容摘要

Meta Superintelligence Labs 发布 Muse Voice Transcribe,称其为首个实时音频感知模型。模型支持实时流式 ASR、20+ 说话人的 diarization 和 endpointing,多语言且可无缝 code-switching,可通过语言、关键词和上下文偏置提升准确率。该模型在 Artificial Analysis 的流式语音转文本和公开 diarization 基准上排名第一。
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:AI at Meta (@AIatMeta)
站内情报编号intel-6e0fdab7932c71788692eeb7