模型发布 / 更新普通
Meta 发布实时语音感知模型 Muse Voice Transcribe
原始标题:Love this, another huge release from Meta. Lunched Muse Voice Transcribe for real-time voice dicta…
内容摘要
Meta 推出 Muse Voice Transcribe,为 MSL 首个实时音频感知模型,今日开始推送,自适应延迟下最终转写词错率低至 3.1%。该模型以 80ms 分块处理音频,在单一流式模型内原生处理说话人分离和端点检测,可自行判断何时输出文字、说话人何时切换;通过 Meta Model API、Meta AI for Mac 和 Muse Code 提供。
内容分类AI 模型发布与更新
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Rohan Paul (@rohanpaul_ai)
站内情报编号intel-d72763cf794b02145cdbd9fe