Gemini(Google)
2026-10-01 创建:整理 Gemini 官方模型谱系。飞书知识库里那篇 gemini 笔记记的是 Gemini 3 Pro 时代的信息,已明显过时。
一句话
Google 的多模态模型家族,主力已迭代到 Gemini 3.8 系列。以超长上下文、原生多模态(文本/图像/音频/视频)和 Agent 能力见长。
⚠️ 3.8 系列后续(2026-10-02 补)
3.8 Flash 之后还有两次发布,笔记此前未记:
| 发布 | 型号 |
|---|---|
| 2026-09-02 | Gemini 3.8 Flash + 3.8 Flash Cyber(网络安全专用) |
| 2026-09-15 | Gemini 3.8 Live / 3.8 Live Extended Thinking(语音) |
| — | Gemini 3.8 Flash TTS 已 GA |
Pro 线仍是 3.1(预览),落后于 Flash 线。
当前主力(2026-10-01 官方核实)
稳定版(Stable)
| 模型 | 定位 |
|---|---|
| Gemini 3.8 Flash | 当前最强的 Flash,为长周期软件工程、自主 Agent、复杂企业流程打造 |
| Gemini 3.7 Flash | 上一代 Flash,复杂编码与 Agentic 工作流 |
| Gemini 3.6 Flash | 上一代,平衡速度与多模态 |
| Gemini 3.5 Flash | 遗留基础档,高吞吐常规任务 |
| Gemini 3.5 Flash-Lite | 3.5 系最快、最省 |
| Gemini 3.1 Flash-Lite | 前沿级性能,成本极低 |
预览版(Preview)
| 模型 | 状态 |
|---|---|
| Gemini 3.1 Pro | Pro 线最高版本,但仍预览——高级智能、复杂问题求解、强 Agentic 与 vibe coding |
| Gemini 3 Flash | 前沿性能、低于旗舰成本 |
| Gemini Omni Flash | 视频生成/编辑/关键帧插值/续写,原生音频 |
| Gemini 3.5 Live Translate | 实时语音互译,支持 70+ 语言 |
⚠️ 版本号要点
- Pro 线明显落后于 Flash 线:最强 Pro 是 3.1(预览),而 Flash 已到 3.8。要强能力目前得用 Flash 系。
- 版本号跨度大:从 3.1 跳到 3.5、3.6、3.7、3.8,中间没有 3.2/3.3/3.4。找型号时别按连续数字推。
- 命名有雷区:
gemini-3-flash-preview是 3 代预览版,不是比 3.8 更新的东西。
已下线的模型(勿再使用)
| 模型 | 状态 |
|---|---|
| Gemini 3 Pro Preview | ⛔ Shut down |
| Gemini 3.1 Flash-Lite Preview | ⛔ Shut down |
| Gemini 2.0 Flash / Flash-Lite | ⛔ Shut down |
| Imagen 4(图像生成) | ⛔ Shut down |
Gemini 2.5 系列(Flash / Flash-Lite / Pro)未废弃但限制访问——只有过去实际用过的用户能调。新项目官方建议直接用 3.5 Flash-Lite 或 3.8 Flash。
图像与视频生成
| 模型 | 定位 |
|---|---|
| Nano Banana Pro(gemini-3-pro-image) | 顶级图像生成编辑,4K、复杂排版、精准文字渲染 |
| Nano Banana 2(gemini-3.1-flash-image) | 高效率大规模视觉创作 |
| Nano Banana 2 Lite | 超低延迟、超低成本,交互式场景 |
| Veo 3.1 / Veo 3.1 Lite | 电影级视频生成,原生同步音频 |
| Gemini Omni Flash | 快速视频生成编辑,原生音频 |
音频与语音
| 模型 | 定位 |
|---|---|
| Gemini 3.8 Live | 默认 Live API 模型,低延迟语音 Agent,无推理延迟 |
| Gemini 3.8 Live Extended Thinking | 高推理语音模型,适合需要后台深度思考的语音交互 |
| Gemini 3.8 Flash TTS | 旗舰 TTS,录音室级音质、Voice 设计/复刻,支持 130 种语言与地区方言 |
| Gemini 3.8 Flash-Lite TTS | 高吞吐低成本 TTS,101 种语言 |
| Gemini 3.5 Transcribe | 低延迟语音转文字,说话人分离、词级时间戳 |
Agent 与工具类模型
| 模型 | 用途 |
|---|---|
| Computer Use(gemini-2.5-computer-use) | 看屏幕并执行 UI 操作(点击、输入、导航),自动化浏览器任务 |
| Gemini Deep Research / Max | 自主规划执行多步研究,产出带引用的交互式报告 |
| Antigravity Agent | 通用托管 Agent,在隔离的 Linux 沙箱内自主执行代码、管理文件、浏览网页 |
| Gemini Robotics ER 2 / ER 1.6 | 具身推理,物理空间理解与多步工具编排 |
其他
- 音乐生成:Lyria 3.5(旗舰,全曲)、Lyria 3 Pro、Lyria 3 Clip(30 秒内)、Lyria RealTime
- Embedding:Gemini Embedding 2(首个多模态 embedding,文本/图像/视频/音频/PDF 统一向量空间)
命名规则
| 后缀 | 含义 |
|---|---|
| 无后缀 / 具体版本号 | 稳定模型,生产环境首选,如 gemini-3.8-flash |
-preview | 预览版,可生产用但限流更严,至少提前 2 周通知弃用 |
-latest | 指向该型号最新版本,会热替换(破坏性变更提前 2 周邮件通知) |
| experimental | 实验版,不适合生产,端点可能随时变 |
版本命名示例
gemini-3.6-flash 稳定
gemini-2.5-flash-preview-09-2025 预览
gemini-flash-latest latest 别名
对我们的价值
能用的场景:
- 超长文档分析(上下文优势明显)
- 多模态任务:截图提取文字、图表分析、户型图理解——这正是 Gemini 3.6 Plus 的强项
- 需要自带报价的批量任务
⚠️ 实测踩过的坑(2026-09-30):gemma-4-31b-it:free(Google 的开源模型,走 OpenRouter)国内 IP 调不通,返回 400「User location is not supported」。Google 系模型在国内网络环境下要留意这个限制。
Gemini CLI:本机装了 gemini skill,走 Gemini CLI 做代码审查和大上下文分析。注意它默认调的大模型与 API 版本可能不是最新的 3.8。
引用来源
- Gemini API Models(官方) —— 2026-09-24 更新
- Gemini 弃用页
相关笔记
- gemini - Gemini CLI skill
- Gemma 4 - Google 的开源模型线,与 Gemini 闭源系列不同
- TraeWork - 模型接入
- API Keys - Key 存放处
相关日记
- 2026-10-01 - 创建,整理 Gemini 3.8 谱系与已下线模型清单