Google7 月 21 日 发布了三款 Gemini 模型——而所有人等待的那一款并不在其中。Gemini 3.6 FlashGemini 3.5 Flash-Lite 以及安全调优版 Gemini 3.5 Flash Cyber 同时上线,而旗舰型号 Gemini 3.5 Pro 仍处于合作伙伴测试阶段,尚未公布发布时间。

更低的输出成本,更新的知识

Gemini 3.6 Flash 的定价为每百万输入 token 1.50 美元、每百万输出 token 7.50 美元,低于上一代 Flash 的 9 美元。Google 表示,它在 Artificial Analysis 指数上的输出 token 数减少了 17%,在 DeepSWE 智能体工程基准上的输出 token 数最高减少 65%——这对智能体运行成本最为关键。其知识截止时间从 2025 年 1 月推进至 2026 年 3 月,覆盖完整的 100 万 token 上下文窗口。

基准成绩跃升

与 3.5 Flash 相比,这款新模型在 DeepSWE 上的得分为 49% 对 37%,在 MLE Bench 上为 63.9% 对 49.7%,在 OSWorld-Verified 上为 83.0% 对 78.4%。Gemini 3.5 Flash-Lite 的价格为每百万 token 0.30/2.50 美元,输出速度约为每秒 350 个输出 token,在 Terminal-Bench 2.1 上几乎将前代表现翻倍(54% 对 31%),并正被纳入 Google Search。

一款大多数人无法使用的模型

Flash Cyber 则是个例外:它经过调优,用于发现并修复安全漏洞,作为 CodeMender 内部的有限访问试点发布,仅限政府和可信合作伙伴使用,理由是双重用途风险,既没有公开 API,也没有公布价格。Google 声称,它在 CyberGym 基准上具备具有竞争力的前沿性能。

然后是 Gemini 4

公告中埋下的一句话分量最重:Google 表示,已经启动 “我们迄今最雄心勃勃的预训练运行,用于 Gemini 4。” 至于 3.5 Pro,公司只重复称其正在与合作伙伴测试,并会在“准备好后尽快”发布——而它在 5 月还告诉开发者,这款模型只差一个月就会到来。