OpenAI 于 8 月 21 日 19:41 UTC 在其开发者论坛发帖称,正在“在接下来的 3 个月里将 GPT-5.6 Sol 的 API 和 credit 价格下调超过 20%”。公司定价页面上的新费率已生效:标准短上下文每百万 token 输入 $4.00、缓存输入 $0.40、输出 $20.00,此前分别为 $5.00、$0.50 和 $30.00。长上下文费率则单独为 $8.00 和 $30.00。

20% 是三项降幅中最小的一项

输入费用正好下降 20%,缓存输入也正好下降 20%。输出费用则从 $30 降至 $20,降幅为 33%。Agentic 和编码工作负载在结构上就是输出密集型——类似 Codex 的循环产生的 token 远多于吸收的 token——因此,OpenAI 争取的这些工作负载的综合节省幅度,实际上比每个标题里的数字都更大。“超过 20%”在字面上没错,但它把便宜的一面说得太保守了。

常见表述错在何处

每篇报道都说 OpenAI “下调了价格”。OpenAI 说的是,未来 3 个月内下调定价。同一公告线程中的一条回复称,这一促销费率至少持续到 2026 年 11 月 21 日。任何按 $4/$20 建模单位经济性的人,建模的都是一张会到期的优惠券,而不是推理成本的结构性下降。第二个误读是受益者是谁:这一变动覆盖了 ChatGPT Work 和 Codex 的 API 以及 credit 余额。OpenAI 自己的表述非常明确——“Pro、Plus 和 Business 订阅的使用情况保持不变。”而这正是几乎所有用户所在的地方,他们的账单并没有变化。

官方给出的原因并非报道中的原因

外界报道把此举归因于竞争压力。OpenAI 给出的理由是效率:“在继续推动能力前沿的同时提升效率。”这也正是 7 月给出的理由,当时 GPT-5.6 Terra 下降了 20%,GPT-5.6 Luna 下降了 80%。同一系列三款模型在一个月内先后改价,更多说明的是 5.6 代的经济性,而不是任何竞争对手的发布时间表——不过,与降价不同,促销是公司既想要规模、又不愿让出价格时会使用的手段。

11 月 21 日值得关注什么

真正的信号将是费率是否回调、是否延长,或是否悄然变成常规定价。到期的促销是定价实验;能持续下来的促销,原本就是公司还不愿称之为永久的降价。