Google DeepMind·· 2026-04-16精选AI 评分73
Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型
Gemini 3.1 Flash TTS: the next generation of expressive AI speech
AI 导读
Google DeepMind 推出文本转语音模型 Gemini 3.1 Flash TTS,支持原生多角色对话与 70 多种语言,并引入音频标签实现对语气、语速及表达风格的细粒度控制。
推荐理由
模型引入了可直接嵌入文本的音频标签来微调语气和节奏,便于开发者在多角色与多语言场景中构建精准可控的对话体验。
来源:Google DeepMind · deepmind.google