产品发布 / 更新普通
Meta 发布实时音频模型 Muse Voice Transcribe,主打语音转写与说话人分离
原始标题:Meta's new real-time audio model is the foundation for AI assistants that never stop listening
内容摘要
Meta Superintelligence Labs 发布首个实时音频感知模型 Muse Voice Transcribe,将音频切分为 80 毫秒块,通过强化学习为每个词动态调整等待时间,并内置说话人区分(可同时区分 20 人以上)和句界检测。
内容分类AI 产品发布与更新
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源The Decoder:AI News(RSS)
站内情报编号intel-227112dee1302fa450af535f