模型发布 / 更新精选
FireRedTeam 开源 FireRedAudio 9B 通用音频语言模型
原始标题:FireRedTeam/FireRedAudio
内容摘要
FireRedTeam 发布 FireRedAudio 的代码与模型,一个基于 9B 参数 LLM 的通用音频语言模型,采用理解与生成解耦的连续表征设计。单模型支持 ASR、音频理解、零样本 TTS、指令 TTS、语义与声学语音编辑,以及最长一小时录音的时序定位理解,在 MMAU、Seed-TTS-Eval 等基准上取得竞争性或领先结果。
内容分类AI 模型发布与更新
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源FireRedTeam:原创语音与多模态项目
站内情报编号intel-23ed1d0d8b4c94ba5a8be1c4