Gemini 2.5 至 3.5 模型发布史
这份索引按模型首次向公众开放的日期排序。Preview、稳定版和日期快照若属于同一能力路线,合并进同一篇文章;普通语言、实时音频、TTS、图像生成和计算机操作模型则按用途分别成篇。这样既不会把 -preview-05-20 一类版本快照误算成新模型,也能保留真正影响选型的产品差异。
口径说明:本文收录 Google 以 Gemini 品牌公开命名、并在应用或开发者平台提供的主要模型。实验性日期快照、仅用于内部路由的别名、SDK 名称变化不单列。发布时间与可用范围截至 2026 年 7 月 28 日;Preview 模型的配额、价格和模型 ID 可能继续变化,调用前应再查官方模型页。
| 首次发布 | 模型 | 核心定位 | 文章 |
|---|---|---|---|
| 2025-03-25 | Gemini 2.5 Pro | 复杂推理、代码与长上下文旗舰 | 详细解读 |
| 2025-04-17 | Gemini 2.5 Flash | 低延迟、高吞吐的通用推理模型 | 详细解读 |
| 2025-05-20 | Gemini 2.5 Flash Native Audio | Live API 的实时原生音频对话 | 详细解读 |
| 2025-05-20 | Gemini 2.5 Pro TTS | 品质优先的可控文本转语音 | 详细解读 |
| 2025-05-20 | Gemini 2.5 Flash TTS | 低延迟、规模化文本转语音 | 详细解读 |
| 2025-06-17 | Gemini 2.5 Flash-Lite | 大规模分类、抽取与轻量生成 | 详细解读 |
| 2025-08-01 | Gemini 2.5 Deep Think | 面向数学、科学和算法的增强推理 | 详细解读 |
| 2025-08-26 | Gemini 2.5 Flash Image | 对话式图像生成与编辑 | 详细解读 |
| 2025-10-07 | Gemini 2.5 Computer Use | 通过视觉与动作控制网页界面 | 详细解读 |
| 2025-11-18 | Gemini 3 Pro | 3 代旗舰推理与 Agent 模型 | 详细解读 |
| 2025-11-20 | Gemini 3 Pro Image | 高保真图像生成、编辑与文字渲染 | 详细解读 |
| 2025-12-04 | Gemini 3 Deep Think | 面向高难推理的增强思考模式 | 详细解读 |
| 2025-12-16 | Gemini 3 Flash | 将 3 代智能下沉到低延迟场景 | 详细解读 |
| 2026-02-19 | Gemini 3.1 Pro | 强化核心推理、编程和工具使用 | 详细解读 |
| 2026-02-26 | Gemini 3.1 Flash Image | 快速高质量图像生成与编辑 | 详细解读 |
| 2026-03-03 | Gemini 3.1 Flash-Lite | 3.1 代高吞吐、低成本模型 | 详细解读 |
| 2026-03-26 | Gemini 3.1 Flash Live | 低延迟双向语音和音频 Agent | 详细解读 |
| 2026-05-19 | Gemini 3.5 Flash | 前沿智能与 Flash 速度的融合 | 详细解读 |
如何读懂发布时间
Google 常用三段式发布:先以 Experimental 或 Preview 收集反馈,再给出稳定模型 ID,最后逐步替换默认别名。因此,“首次发布”不等于“稳定版上线”,也不等于“所有地区、产品和计费层同时可用”。每篇文章都会单独列出生命周期节点。
一句话选型
- 质量优先、任务复杂:从当代 Pro 开始评估。
- 延迟和成本优先:优先 Flash;规模更大、任务更简单时考虑 Flash-Lite。
- 实时对话选择 Live/Native Audio;把文本合成为成品音频选择 TTS。
- 图像生成或局部编辑:选择 Image 系列,而不是要求文本模型间接绘图。
- 网页操作:Computer Use 负责感知与动作规划,但必须配合权限隔离、动作确认和审计。
- 极难数学、科学或算法推理:Deep Think 更合适,但通常换来更高延迟和更低配额。
资料核验原则
文章优先引用 Google DeepMind、Google 官方博客 与 Gemini API 文档。第三方榜单只适合观察趋势,不能替代在自己的数据、延迟预算和安全约束下测试。