跳到正文
Google DeepMind·· 2026-04-16精选AI 评分73

Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型

Gemini 3.1 Flash TTS: the next generation of expressive AI speech

AI 导读

Google DeepMind 推出文本转语音模型 Gemini 3.1 Flash TTS,支持原生多角色对话与 70 多种语言,并引入音频标签实现对语气、语速及表达风格的细粒度控制。

推荐理由

模型引入了可直接嵌入文本的音频标签来微调语气和节奏,便于开发者在多角色与多语言场景中构建精准可控的对话体验。

来源:Google DeepMind · deepmind.google