AI圈报
产品发布 / 更新普通

阿里 Qwen 发布 Qwen-Audio-3.1 五款语音模型,语音价格最高下调 95%

信息来源:The Decoder:AI News(RSS)·
原始标题:Alibaba launches Qwen Audio 3.1 with new models and slashes AI audio prices by up to 95 percent

内容摘要

阿里 Qwen 团队发布 Qwen-Audio-3.1,包含五款覆盖语音识别(ASR)、语音合成(TTS)和实时交互的模型。ASR 改进多语言和方言识别并自动清理填充词,ASR-Next 支持多说话人识别、时间戳及情绪和环境声检测;TTS-Next 将语言模型与扩散方法结合,可一次性生成语音、音效和背景音频。同步降价:TTS 约 70%,Realtime 约 85%,ASR 最高 95%。
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源The Decoder:AI News(RSS)
站内情报编号intel-6d2e17aebb2ff161fdc0c09b