OpenAI reduziu discretamente a quantidade de contexto que sua ferramenta de programação Codex fornece ao GPT-5.6, e os desenvolvedores que dependem de longas sessões agentivas não gostaram. A janela de contexto de entrada configurada por padrão caiu de 372.000 para 272.000 tokens — um corte de cerca de 27% — feito por meio do pull request do GitHub #34009.
O que mudou
A janela de contexto é a memória de trabalho de um agente de programação: o intervalo de código, instruções e conversas anteriores que o modelo pode manter ao mesmo tempo. Encurtá-la em cerca de um quarto significa que o Codex consegue manter menos de uma sessão em vista antes de precisar resumir e descartar material anterior — um processo conhecido como compactação.
Por que os desenvolvedores perceberam
O efeito prático pesa mais em tarefas longas e com vários arquivos. "Menos memória por sessão significa que o agente de IA esquece mais cedo partes anteriores de uma sessão longa de programação", disse o analista Pareekh Jain. Outra, Muskan Bandta, observou que "muitos desenvolvedores estão dizendo que suas sessões agora passam mais tempo compactando do que realmente trabalhando" — a ferramenta ocupada em gerenciar a própria memória em vez de escrever código.
Nenhuma justificativa declarada
A OpenAI não explicou publicamente a mudança, deixando os desenvolvedores a inferir a motivação. O candidato óbvio é o custo: fornecer uma janela de contexto maior consome mais computação por solicitação, então reduzi-la discretamente diminui a despesa de operar o Codex em escala — o tipo de trade-off que laboratórios fazem cada vez mais à medida que a demanda por inferência pressiona a capacidade.
Como se adaptar
Analistas dizem que a solução é fluxo de trabalho, não reclamação. As equipes devem "projetar fluxos de trabalho que gerenciem proativamente o contexto", disse o analista Amit Jena — dividindo o trabalho em tarefas menores, recorrendo mais a mecanismos de recuperação e monitorando o consumo de contexto. É um lembrete de que a capacidade útil de uma ferramenta de IA pode mudar sem aviso, e de que construir com base em um orçamento fixo de contexto é arriscado.
