截至 2026 年 8 月 19 日,Google Gemini 已经不是「一个模型、两个档位」。Flash 线在 8 月 13 日刚放出 Gemini 3.7 Flash;Pro 线仍停在 2 月的 Gemini 3.1 Pro。DeepMind 产品页还写着 3.5 Pro coming soon。所以「最新」要拆成两句:最新工作马是 3.7 Flash;最强推理旗舰仍是 3.1 Pro(可开 Deep Think)。
本文按官方产品页、Firebase / Gemini API 模型表,以及 8 月 13 日 Google 博客对 3.7 Flash 的说明整理。不要按版本号大小选模型:3.7 并不自动压过 3.1 Pro。适合写进路由表的是角色,不是数字。
现在「最新」到底指哪几个
2026 年夏天 Google 把 Gemini 拆成多条时间线。DeepMind 首页当前置顶的是:
- Gemini 3.7 Flash:复杂 Agent 任务、规模化编码。8 月 13 日正式介绍,距 3.6 Flash(7 月 21 日)约三周。
- Gemini 3.5 Flash-Lite:高吞吐、要效率和智力兼顾的轻量档。
- Gemini 3.1 Pro:复杂任务与把创意做成可交付物;旁注仍是 3.5 Pro coming soon。
- Gemini 3.1 Deep Think:科学、研究、工程里的硬题,加长推理。
消费者侧:Gemini Spark(Google AI Pro / Ultra,160+ 国家)从 8 月 13 日起改用 3.7 Flash。免费 Gemini App 仍大量默认 3.6 Flash。别把 App 里看到的名字和 API 里 gemini-3.7-flash 当成同一份 SLA。
- 没有公开的「Gemini 3.5 Pro / 3.6 Pro / 3.7 Pro」——Pro 还停在 3.1
- 3.7 Flash 是工作马升级,不是新一代旗舰取代 3.1 Pro
- 图像线叫 Gemini Image,对外绰号 Nano Banana,不要和文本 Flash 混成一个 endpoint
按用途的排名,不是智商排行榜
把「全系列排名」理解成一条 IQ 榜会选错。更稳的是按任务角色排:
- 最难推理 / 长文档 / 要 Deep Think:Gemini 3.1 Pro(必要时 Deep Think)。这是当前公开旗舰,不是 3.7。
- 生产级 Agent、编码、知识工作吞吐:Gemini 3.7 Flash。官方强调相对 3.6 的编码、网页生成、PDF 理解、工作流自动化。
- 接近 Pro 智力、仍走 Flash 价:Gemini 3.5 Flash(稳定档,Firebase 写明停服不早于 2027-05-19)。
- 免费 App 默认、求稳:Gemini 3.6 Flash。
- 海量分类、抽取、子 Agent:Gemini 3.5 Flash-Lite。
- 遗留兼容:Gemini 2.5 Pro / Flash / Flash-Lite——Firebase 写明最早可能 2026-10-16 关停,新项目不要再绑死。
官方放出的 3.7 vs 3.6 数字(同一 Flash 档内部,不是对 3.1 Pro):FrontierCode 1.1 Main 43.6% vs 34.4%;DeepSWE v1.1 65.3% vs 约 49%;GDP.pdf 34.0% vs 22.0%;AutomationBench 30.4% vs 17.0%;WebDev Arena Elo 1588 vs 1538。这些说明 Flash 线自己在变强、变便宜,不能直接读成「已经超过 Claude / GPT 旗舰」。
Flash 与 Pro 为何不再同步升级
2025 年底 Gemini 3 开代:3 Pro 预览、Deep Think、3 Flash。进入 2026 年后,Flash 连发 3.5 → 3.6 → 3.7,Pro 停在 3.1。产品含义是:
- Flash 负责延迟、价格、Agent 循环次数、工具调用纪律。
- Pro 负责「这一题值得多烧推理」——长上下文、多模态硬题、Deep Think。
- 路由层不要写成
latest一把梭。默认流量走 3.7 Flash,失败或评分过低再升 3.1 Pro,比全站绑 Pro 便宜一个数量级。
3.7 Flash 引入价(至 2026-12-31):输入 $0.75 / 1M tokens、输出 $3.75 / 1M,约为原 3.6 标价的一半;2027-01-01 起回到 $1.50 / $7.50。上下文:输入约 1M、输出 64k。工具面:函数调用、Search as a tool、Computer use。渠道:Gemini API / AI Studio、Android Studio、Antigravity、Gemini Enterprise Agent Platform。
全系列怎么分:Lite、图像、Deep Think、生态位
Flash-Lite:量大、要快、成本敏感
3.5 Flash-Lite 是当前 Lite 主力:收据抽取、翻译、大量并行子任务。DeepMind 演示里它比 3.5 Flash 更低延迟,也可在 3.6 Flash 当主 Agent 时批量出设计稿。更早的 3.1 Flash-Lite 在部分控制台仍能看到,新流量应迁到 3.5 Lite,除非你有钉死的评测集。
Nano Banana / Gemini Image
图像不是 Flash 文本模型的附赠参数。当前常见分档:
- Gemini 3.1 Flash Image(Nano Banana 2):对话式改图、多图融合、角色一致性。
- Gemini 3 Pro Image:更高保真、可读文字、最多约 14 张参考图。
- Gemini 3.1 Flash-Lite Image(Nano Banana 2 Lite):高吞吐、延迟敏感的素材流水线。
Google 演示 3.7 Flash 做 3D 小游戏时,角色与贴图是 Flash 编排 + Nano Banana 出图。产品里应拆成两个调用,而不是指望一个 gemini-3.7-flash 扛完生成式视觉。
Deep Think、Omni、Audio、Robotics、Embedding
- 3.1 Deep Think:Pro 上的加长推理模式,科学 / 数学 / 长程 Agent;更贵、更慢,不要当聊天默认。
- Gemini Omni:视频与「从任意模态做东西」,3.7 演示里曾编排 Omni 做视差落地页。
- Gemini Audio:实时语音。
- Gemini Robotics / Robotics ER 2:视觉—语言—动作,不在普通 Chat API 里混用。
- Gemini Embedding 2:多模态向量,检索与 RAG 用,别拿生成模型当 embed。
- 3.5 Flash Cyber:漏洞发现与修复向的专用档,安全产品单独评估,不要当通用编码模型。
对照表:选哪个、别选哪个
| 模型 | 角色 | 适合 | 不要用来 |
|---|---|---|---|
| 3.1 Pro | 旗舰推理 | 难例、长文档、要 Deep Think | 高 QPS 闲聊、每步都 Pro |
| 3.7 Flash | 最新工作马 | 编码 Agent、工作流、多数生产流量 | 当成「已经发布的 3.7 Pro」 |
| 3.6 Flash | 免费 App 默认 | 消费端一致性、过渡期对照 | 新生产默认(除非评测证明更好) |
| 3.5 Flash | 稳定近 Pro | 要长支持窗口的合同项目 | 无视 2027 年停服条款 |
| 3.5 Flash-Lite | 便宜快 | 抽取、分类、并行子 Agent | 单次超长硬推理 |
| 2.5 系列 | 遗留 | 旧集成的缓冲期 | 2026 年 10 月后的新绑定 |
| Image / Nano Banana | 生图改图 | 素材、UI 参考、角色一致 | 代替文本模型做架构设计 |
API 名称、价格窗口与停服风险
写进配置时用文档里的稳定 ID,例如 gemini-3.7-flash、gemini-3.6-flash、gemini-3.5-flash、gemini-3.1-pro、gemini-2.5-pro。Flash 3.x 里较新的版本被标成 short-term availability,停服日期常是 TBD;3.5 Flash 明确不早于 2027-05-19。2.5 系列最早可能 2026-10-16 关。预览 ID(如历史上的 gemini-3-flash-preview)不要进生产别名。
价格只对 3.6 / 3.7 Flash 的引入窗口负责:2026 年底前的折扣会在 2027 元旦消失。评测和合同要用「引入价到期后」再算一遍 TCO。
开发者怎么落到路由表
- 默认 3.7 Flash。 编码、工具循环、文档转页面、多数 Workspace Agent 从这里起。
- 难例升 3.1 Pro / Deep Think。 用评测分数或人工抽检触发,不要用户一句话就升舱。
- 批量边车用 3.5 Flash-Lite。 抽字段、译收据、扇出 20 个草稿。
- 图走 Image 模型。 文本模型只负责提示词与编排。
- 2.5 在 10 月前迁走。 留一个月对照日志,不要拖到关停公告当天。
- 隔离评测机。 换模型会打爆本机 GPU/内存故事——云上 Mac 更适合并行跑同一套 harness。需要独立编译与 Agent 循环时,用 Cloud Mac 把评测和日常笔记本拆开。
- 这是一次要登顶的推理,还是一万次要控成本的循环?
- 失败代价是幻觉一句,还是合并错分支?后者才值得 Pro
- 输出是代码/JSON,还是像素?像素走 Nano Banana
FAQ
2026 年 8 月 Gemini 最新模型是哪一个?
按发布时间,最新公开工作马是 Gemini 3.7 Flash(2026-08-13)。按推理上限,旗舰仍是 Gemini 3.1 Pro(可开 Deep Think)。没有已发布的 3.7 Pro。
有 Gemini 3.5 Pro 吗?
截至撰稿,DeepMind 仍写 3.5 Pro coming soon。不要在架构图里画一个还不存在的 3.5/3.6/3.7 Pro。
免费 Gemini App 是 3.7 吗?
不一定。免费端仍常见 3.6 Flash;3.7 优先进付费 Spark、API 与企业 Agent 平台。以产品内模型选择器为准。
Nano Banana 是不是 Gemini 3.7?
不是。Nano Banana 是 Gemini Image 家族的绰号,和 3.7 Flash 文本工作马分开计费、分开调用。3.7 演示里两者是编排关系。
2.5 还能用吗?
能,直到文档里的关停窗口。Firebase 写 2.5 Pro/Flash/Flash-Lite 最早可能 2026-10-16。新项目用 3.x。
结语
三句话:最新工作马是 3.7 Flash;最强公开推理仍是 3.1 Pro;Flash 与 Pro 已经不同步,版本号不是能力排序。 选模型先写角色(默认循环 / 难例升级 / 抽取边车 / 生图),再填 ID。等 3.5 Pro 真的到来时,只改路由表里的「升舱」那一行,不必重写产品。
苹果侧若关心 Siri 与 Gemini 训练合作的边界,见 8 月 18 日秋季发布会软件前瞻。那是 AFM 蒸馏,不是把 Gemini App 装进 iPhone。
换模型评测时,别和日常开发抢同一台 Mac
3.7 Flash 与 3.1 Pro 要同一套 harness 才有意义。把 Agent 循环放到独立 Cloud Mac,笔记本留给看 diff。