OpenAI 于周四重定其 API 定价,并附上了一段不同寻常的解释:公司称,其自身的前沿模型重写了生产环境中为模型提供服务的内核。
价格
按每百万 token 计,GPT-5.6 Luna 现为 输入 $0.20 / 输出 $1.20,较 7 月 9 日发布时的 $1 和 $6 下调 80%。Terra 下调 20%,至 $2 和 $12。缓存输入在两种计价下都只需缺失价格的十分之一。如今,Luna 的输入价格低于 Gemini 3.1 Flash-Lite,大约只有 Claude Haiku 4.5 输入价格的五分之一。
旗舰型号没有变化
各家标题已趋于一致:“OpenAI 将价格最高下调 80%”。Sol 今天的价格仍是输入 $5 / 输出 $30,发布时也是 $5 / $30——降幅为 0%。80% 的降幅适用于该系列中最小的模型。Axios 甚至写出了自相矛盾的标题“OpenAI 为 GPT-5.6 Luna 和 Terra 打折,但不是 Luna”。
因果说法是反着来的
OpenAI 的更新日志写道:“借助 Codex,GPT-5.6 Sol 自主重写并优化了我们的生产内核”,使用的是 Triton 和 Gluon,带来了 端到端服务成本 20% 的下降,以及通过投机解码实现的 15% 以上 token 生成效率提升。有些报道把这解读成“Sol 重写了自己的推理栈,从而为降价买单”。20% 的成本节省不可能支撑 80% 的价格下调。Luna 的重新定价是一项针对 Google 和 Anthropic 的竞争举措;内核工作则是另一项——而且可以说更具影响力的——主张。“自主”一词也很关键:表述是“借助 Codex”,即一个带有人类审核、在任何内容进入生产环境前进行把关的代理式框架。
快速模式只是统一翻倍
Priority Processing 已被取消,取而代之的是 Fast mode,带有 priority 标记的请求会自动迁移。Fast mode 在 Sol、Terra 和 Luna 上都正好是标准费率的 两倍。更新日志仅对 Sol 证明了“最高快 2.5 倍”。Terra 和 Luna 同样收取 100% 溢价,但没有公布对应速度数据。
