Skip to content

Gemini 3.8 Flash TTS 发布详解:日期、定位与选型

更新日期:2026年09月24日。发布日期与能力依据 Google 官方日志;价格、额度和区域可用性以调用时的官方文档为准。

Gemini 3.8 Flash TTS 于 2026-09-22 首次公开发布,核心定位是创意配音、细腻表演与长篇语音稳定性。它是新一代文字转语音模型。官方将其定位为旗舰创意 TTS,强调声音保真度、细腻表演、方言以及长篇多轮内容的稳定性,适合用来评估旁白、有声内容和要求表演控制的配音。

一、Gemini 3.8 Flash TTS 发布信息

项目信息
首次公开发布2026-09-22
本文记录的版本状态正式版(GA)
模型 IDgemini-3.8-flash-tts
主要用途创意配音、细腻表演与长篇语音稳定性
日期依据Google 官方发布日志

二、Gemini 3.8 Flash TTS 生命周期与版本区别

2026 年 9 月 22 日与 Gemini 3.8 Flash-Lite TTS 同日正式发布。此次发布还引入 /v1beta/voices 端点、文本提示语音设计、经同意的语音复刻,以及超过 150 种预构建和自定义语音的查询能力。

三、选型与迁移建议

创作流程应先审核脚本,再测试角色一致性、停顿、数字读法和长篇内容衔接。若主要目标是批量生产效率,可同时比较 Flash-Lite TTS。语音复刻需要取得声音权利人的同意,不能将可创建自定义语音理解为可任意模仿他人。

四、常见问题

它是否是实时语音对话模型?

不是。它负责把文本转换为语音;若需要模型持续听取用户并回复,请查看 3.8 Live 系列。

官方资料与后续核验

以上记录用于理解 Gemini 3.8 Flash TTS 的发布背景;接入前请再次核对官方说明。其他模型与发布时间见 Gemini 模型发布史

最后更新于:

Gemini 中文版博客