AI圈报
模型发布 / 更新精选

GLM-TTS:基于多奖励融合强化学习,实现工业级语音合成

信息来源:智谱:研究(网页内嵌数据)·

内容摘要

GLM-TTS 采用 GRPO 多奖励强化学习框架,融合字符错误率、相似度、情感及笑声奖励,实现 3 秒零样本音色克隆。在 seed-tts-eval 测试中 CER 低至 0.89% 达开源 SOTA,情感表达显著优于阿里、百度等商用模型。支持 15% 参数 LoRA 微调定制精品音色,通过 Phoneme-in 混合输入精准控制多音字发音,配合自研 2D-Vocos 声码器提升音质与音域覆盖。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源智谱:研究(网页内嵌数据)
站内情报编号intel-416337eae88c546c781757cd