AI圈报
产品发布 / 更新普通

Meta 发布实时音频模型 Muse Voice Transcribe,主打语音转写与说话人分离

信息来源:The Decoder:AI News(RSS)·
原始标题:Meta's new real-time audio model is the foundation for AI assistants that never stop listening

内容摘要

Meta Superintelligence Labs 发布首个实时音频感知模型 Muse Voice Transcribe,将音频切分为 80 毫秒块,通过强化学习为每个词动态调整等待时间,并内置说话人区分(可同时区分 20 人以上)和句界检测。
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源The Decoder:AI News(RSS)
站内情报编号intel-227112dee1302fa450af535f