Gemini 3.1 Flash TTS 发布详解:日期、定位与选型
更新日期:2026年09月24日。发布日期与能力依据 Google 官方日志;价格、额度和区域可用性以调用时的官方文档为准。
Gemini 3.1 Flash TTS 于 2026-04-15 首次公开发布,核心定位是经济实惠、可控且富有表现力的文字转语音。它接收文本并合成语音,适合旁白、朗读和多角色配音。与实时音频对话模型相比,TTS 的核心是把已经确定的台词准确表达出来,便于对文案、发音和语气分别验收。
一、Gemini 3.1 Flash TTS 发布信息
| 项目 | 信息 |
|---|---|
| 首次公开发布 | 2026-04-15 |
| 本文记录的版本状态 | 公开预览版 |
| 模型 ID | gemini-3.1-flash-tts-preview |
| 主要用途 | 经济实惠、可控且富有表现力的文字转语音 |
| 日期依据 | Google 官方发布日志 |
二、Gemini 3.1 Flash TTS 生命周期与版本区别
2026 年 6 月 17 日,官方为该模型增加了流式语音生成支持,包括 streamGenerateContent 和 Interactions API 的流式模式。这是既有模型的能力更新,不应将 6 月 17 日记为首次发布日期。
三、选型与迁移建议
2026 年 9 月 22 日发布的 Gemini 3.8 Flash-Lite TTS 被官方定位为这一预览模型的替代方案。迁移时应比较音色、发音、首段音频延迟和长文本稳定性;“替代方案已发布”不等于旧端点当天已经关闭。
四、常见问题
应怎样记录流式功能上线?
保留 4 月 15 日为模型首次发布时间,把 6 月 17 日记在生命周期中。这样可以区分新模型与接口能力更新。
官方资料与后续核验
以上记录用于理解 Gemini 3.1 Flash TTS 的发布背景;接入前请再次核对官方说明。其他模型与发布时间见 Gemini 模型发布史。