AI圈报
模型发布 / 更新精选

通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型

信息来源:公众号:通义实验室(千问)·
原始标题:从"能说话"到"会表达":Qwen-Audio-3.0-TTS 发布

内容摘要

通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约300ms)和 Plus 两个版本。Plus 版本在 Artificial Analysis 榜单夺冠,支持16种语言和20种中文方言,平均 WER/CER 低至3.87(Flash),说话人相似度最高达82.75(Plus)。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源公众号:通义实验室(千问)
站内情报编号intel-d257c14e818cb3eacf62c34e