A alegação de que o GPT-5.6 Sol teria tido seu preço reduzido pela metade circulou amplamente em 17 de agosto. Ela é meia verdade de um jeito que importa para quem faz orçamento de inference. OpenRouter está oferecendo o modelo por US$ 2,50 por 1 milhão de tokens de entrada e US$ 15 por 1 milhão de tokens de saída, exibido com um selo de 50% de desconto sobre preços riscados de US$ 5,00 e US$ 30,00. Esses valores riscados continuam sendo os preços reais da OpenAI.
O que dizem as duas tabelas de preços
A página de preços para desenvolvedores da OpenAI, verificada diretamente, lista GPT-5.6 Sol a US$ 5,00 na entrada e US$ 30,00 na saída por milhão de tokens. Para referência, a mesma página lista Terra a US$ 2,00/US$ 12,00 e Luna a US$ 0,20/US$ 1,20. Nenhum desconto ou promoção é mencionado em lugar algum. As únicas estruturas de preços especiais publicadas pela OpenAI são as padrão: níveis batch, flex e fast, tarifas de entrada em cache e um acréscimo de 10% para endpoints de processamento regional.
Onde a formulação comum erra
"A OpenAI corta os preços do GPT-5.6 Sol em 50%" está errado no escopo e provavelmente na duração. No escopo: trata-se de uma promoção em um gateway, não de uma mudança no preço de tabela do modelo. Quem chama a API da OpenAI diretamente, ou por qualquer outro caminho, continua pagando US$ 5 e US$ 30 — nada no custo do modelo mudou. Na duração: a página da OpenRouter mostra o desconto, mas informa nenhuma data de término, e a promoção não aparece na própria página de anúncios da OpenRouter. Um desconto sem vencimento publicado não é uma reprecificação, e uma projeção de gastos construída sobre US$ 2,50/US$ 15 embute um precipício de data desconhecida.
Por que um desconto ficaria no gateway
Os gateways são onde os compradores realmente comparam preços. Um desenvolvedor que escolhe um modelo em um agregador vê o Sol ao lado de cada concorrente com o custo por token impresso ao lado de cada um; um desenvolvedor que lê a documentação da própria OpenAI não vê isso. Aplicar desconto no local em que a substituição acontece compra participação no ponto de decisão, enquanto deixa intacto o preço publicado — o número ao qual contratos corporativos e modelos de analistas se ancoram.
A consequência para a curva de custos
A afirmação padrão de que os custos de inference caem em certa porcentagem por ano é calculada a partir dos preços de tabela. Se o preço real da transação passa a depender cada vez mais de por qual portal uma solicitação é roteada e de quais promoções estão ativas naquele mês, o preço de tabela deixa de ser uma medida confiável de qualquer coisa. Dois desenvolvedores executando cargas de trabalho idênticas no mesmo modelo podem agora estar pagando valores duas vezes diferentes, e nenhum dos preços está errado.
