在 5 月 19 日于 I/O 开发者大会上发布时,Google 曾将旗舰模型 Gemini 3.5 Pro 的正式发布定在 6 月,但如今该公司已将其推迟至 7 月。截至 6 月下旬,该模型仍处于受限的 Vertex AI 企业预览阶段,而非全面开放。
迄今最大的上下文窗口
从纸面上看,Gemini 3.5 Pro 野心十足。Google 表示,这款模型拥有 200 万 token 的上下文窗口——是 Gemini 3.5 Flash 的 100 万 token 窗口的两倍,也按 Google 的说法,是所有已投入生产的前沿模型中最大的。它还内置 Deep Think 推理模式,面向最棘手的科学、数学和编程问题。
Google 目前尚未公布官方基准测试;该公司表示,完整结果将在正式开放时发布。第三方估算显示,其定价接近每百万输入 token 2 美元、每百万输出 token 12 美元,不过 Google 尚未确认最终费率。
Google 为何按下发布时间
该公司将延期归因于企业测试用户的反馈,称其在长时间、代理式任务中存在 token 消耗过高 的问题。早期测试还暴露出编程表现尚未达到 Google 对旗舰级产品的预期,以及其在长链路、多步骤推理方面仍未达到公司为该模型设定的标准。
这次延期带来的关注已超出产品本身。据报道,大约在同一时期,几位谷歌高级研究人员转投竞争对手 Anthropic,而投资者对延期的担忧则令 Google 市值大幅下挫。与此同时,Google 仍在推动其他产品线,Gemini 3.5 Flash 已在 I/O 上进入全面开放。
拥挤的发布时间窗口
这个时间点颇为尴尬。Anthropic 已于 6 月 30 日发布 Claude Sonnet 5,OpenAI 也在分阶段推出下一代模型,这使 Gemini 3.5 Pro 成为本季仍待亮相的少数旗舰发布之一。7 月的发布时间还可能与美国即将出台的前沿模型发布框架发生冲突;该框架或将把这款模型归类为“受监管”系统,要求在广泛部署前接受政府审查。