谷歌一口气发三款 Flash:先降价,Gemini 4 已在路上
Gemini 3.6 Flash 与 3.5 Flash-Lite 今日上线,价格更低、基准分数大涨(均为谷歌自报)——更重磅的是:Gemini 4 的预训练已经悄悄开跑。
60 秒版本
谷歌一次发布三款廉价 Gemini 模型——3.6 Flash、3.5 Flash-Lite 与管控版 Flash Cyber——并确认 Gemini 4 预训练已启动。
要点
- 3.6 Flash:输出 token 少 17%(自报),定价 $1.50/$7.50 每百万,知识截止更新至 2026 年 3 月
- 3.5 Flash-Lite:$0.30/$2.50 每百万;谷歌称已反超上代正装版 3 Flash
- Flash Cyber 专职找漏洞补漏洞——仅对政府和可信伙伴试点开放
- 全部基准均为谷歌自报;3.5 Pro 仍在伙伴测试中
结论. 若自报数字经得起检验,这是一次实打实的降价提效——但真正的头条只有一句话:Gemini 4 已开始预训练。
发布了什么三款 Flash 模型,外加一句响亮的预告
在所有人等待 Gemini 3.5 Pro 的时候,谷歌先翻新了小模型阵容:Gemini 3.6 Flash(日常主力,更省更便宜)、Gemini 3.5 Flash-Lite(高吞吐档),以及 Gemini 3.5 Flash Cyber(严格管控的安全专用款)。同时谷歌确认:Gemini 4 的预训练已经开始。
Gemini 3.6 Flash卖点是效率,不是智商
谷歌给 3.6 Flash 的核心说法是「用更少完成同样多」:比 3.5 Flash 少 17% 的输出 token(按 Artificial Analysis 指数),多步骤任务的推理步骤和工具调用也更少。对智能体场景,这才是关键数字——模型中间的每一步都要付费,少绕路等于双重省钱。标价同样下调:每百万输入 1.5 美元、输出 7.5 美元,此前输出为 9 美元。
能力方面,谷歌称编码更「干净」——不必要的代码改动和重复执行更少:DeepSWE 从 37% 升至 49%,机器学习工程基准 MLE Bench 从 49.7% 升至 63.9%,知识型工作(GDPval-AA)从 1349 分涨到 1421 分,OSWorld 电脑操作从 78.4% 提至 83%。最低调却可能最有感的变化:知识截止日期从 2025 年 1 月跃至 2026 年 3 月,整整前进 14 个月。

Gemini 3.5 Flash-Lite廉价档追平了昨天的中端
Flash-Lite 面向高吞吐、低延迟任务——智能体搜索、批量文档处理——定价 每百万输入 0.3 美元、输出 2.5 美元。对比三月那代 3.1 Flash-Lite,谷歌给出的提升幅度很大:
| Terminal-Bench 2.1(智能体编程) | 54% 对 31% |
|---|---|
| GDM-MRCR v2(长上下文) | 72.2% 对 60.1% |
| GDPval-AA v2(真实任务) | 1140 对 642 |
| 价格(输入 / 输出,每百万) | $0.30 / $2.50 |
更值得玩味的说法是:谷歌称这款 Lite 已经反超上一代正装版 Gemini 3 Flash——SWE-Bench Pro 54.2% 对 49.6%,OSWorld-Verified 74.0% 对 65.1%。若经独立测试坐实,这就是「能力沿价格阶梯快速下沉」的教科书案例。
Gemini 3.5 Flash Cyber安全专家,特意拴上了绳
最特殊的是 Flash Cyber:专为大规模检测、验证、修补代码安全漏洞而调校,谷歌的 CodeMender 工具由多个这样的智能体协同驱动。谷歌称目标是让「一线防御者抢先一步」处理关键漏洞。但注意开放方式:仅限政府与可信伙伴的小范围试点。能廉价挖漏洞的模型天然是双刃剑,克制的发布节奏说明谷歌心里有数。
接下来小模型养家,Gemini 4 在炉子里
Gemini 3.6 Flash 与 3.5 Flash-Lite 今日已在 Gemini 应用上线,Flash-Lite 还将进入搜索;开发者可通过 Google Antigravity、AI Studio 和 Android Studio 调用。Gemini 3.5 Pro 仍在「与伙伴测试中」,「准备好就发布」。而整份公告里最有分量的一句:DeepMind 表示已启动迄今最有野心的预训练——目标 Gemini 4。
token 效率才是智能体的真实成本——而真正会被记住的新闻,只有关于 Gemini 4 的那一句。