模型发布 / 更新精选
Gemini 3.5 Transcribe 发布:面向实时语音交互的高精度语音转文本模型
原始标题:Intelligent transcription with Gemini 3.5 Transcribe
内容摘要
Google DeepMind 推出 Gemini 3.5 Transcribe 语音转文本模型,支持流式与非流式两种 API。据 Artificial Analysis 评测,其流式与非流式平均词错率分别为 4.0% 和 2.6%,支持超 85 种语言、自定义词汇及最多三人说话人识别。
内容分类AI 模型发布与更新
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Google DeepMind:Blog(RSS)
站内情报编号intel-e3981287973b29e204557a7c