Google 的下一代旗舰模型再度延期,而这一次,原因据称不只是打磨优化。据多家媒体报道,Google DeepMind 已将 Gemini 3.5 Pro 从 6 月的目标推迟到大约 7 月 17 日,并弃用了该模型的基础——即建立在 Gemini 2.5 Pro 架构上的底座——转而重新启动一次全新的预训练。Google 尚未正式公布发布日期,发言人也拒绝就时间安排置评。

“弃用基础模型”是什么意思

DeepMind 据称没有在 2.5 Pro 的基础上进行渐进式改进,而是彻底放弃了这一路线——在原定部署前数日将该架构从生产流程中移除,并选择从头重做。短期代价是延期,换来的则是报道所称的“深度升级的基础”。

据称的原因

据这些报道所描述的泄露内部评估显示,被弃用的模型在 递归工具调用、多步 数学推理 以及生成复杂、多层布局和 SVG 场景时的 结构一致性 方面表现不佳——而这些领域,竞争对手已经更为稳定。重建后的模型据称将瞄准 200 万 token 的上下文窗口、用于多步问题的 “Deep Think” 推理层,以及更强的图像和前端生成能力。上述细节均未获 Google 证实;应将其视为泄露信息,而非发布说明。

对团队阵容而言,这是糟糕的一个月

此次延期让 DeepMind 6 月本就不顺的人员变动更加严峻。Gemini 联席负责人、2017 年论文“Attention Is All You Need”的共同作者 Noam Shazeer 转投 OpenAI;一天后,诺贝尔奖得主、AlphaFold 创始人 John Jumper 离开并加入 Anthropic,研究员 Jonas Adler 和 Alexander Pritzel 随后也相继离职。Demis Hassabis 对这一说法予以反驳,他对 Semafor 表示,DeepMind 仍拥有“迄今为止所有实验室中最大、最广的研究阵容”。

在预览中独自前行

这一时点颇为不利。随着 OpenAI 的 GPT-5.6 于 7 月 9 日向公众推出,以及 SpaceXAI 的 Grok 4.5 已经上线,Gemini 3.5 Pro 仍被限制在 Vertex AI 的企业预览中——这使 Google 成为唯一没有公开可用的新旗舰模型的主要前沿实验室。自 GPT-5.6 发布后,Gemini 3.5 Pro 每多停留一天预览阶段,Google 的定位问题就加深一分,而在模型真正发布之前,这一问题无法靠基准测试解决。