OpenAI ha ridotto in silenzio la quantità di contesto che il suo strumento di coding Codex fornisce a GPT-5.6, e gli sviluppatori che fanno affidamento su lunghe sessioni agentiche non sono contenti. La finestra di contesto di input preconfigurata è scesa da 372.000 a 272.000 token — un taglio di circa 27% — tramite la pull request di GitHub #34009.

Cosa è cambiato

La finestra di contesto è la memoria di lavoro di un agente di coding: l'insieme di codice, istruzioni e conversazioni precedenti che il modello può mantenere in una sola volta. Ridurla di circa un quarto significa che Codex può tenere sotto osservazione una parte più piccola di una sessione prima di dover riassumere e scartare il materiale precedente — un processo noto come compattazione.

Perché gli sviluppatori se ne sono accorti

L'effetto pratico colpisce soprattutto i compiti lunghi e su più file. "Less memory per session means the AI agent forgets earlier parts of a long coding session sooner," ha affermato l'analista Pareekh Jain. Un'altra, Muskan Bandta, ha osservato che "a lot of developers are saying their sessions now spend more time on compacting than actually working" — lo strumento impegnato a gestire la propria memoria invece di scrivere codice.

Nessuna motivazione dichiarata

OpenAI non ha spiegato pubblicamente il cambiamento, lasciando agli sviluppatori il compito di dedurne il motivo. Il candidato più ovvio è il costo: servire una finestra di contesto più ampia richiede più calcolo per richiesta, quindi ridurla in silenzio abbassa la spesa per far funzionare Codex su larga scala — il tipo di compromesso che i laboratori fanno sempre più spesso mentre la domanda di inferenza mette sotto pressione la capacità.

Adattarsi al cambiamento

Gli analisti dicono che la soluzione è nel flusso di lavoro, non nelle lamentele. I team dovrebbero "design workflows that proactively manage context," ha detto l'analista Amit Jena — suddividendo il lavoro in compiti più piccoli, affidandosi di più ai meccanismi di retrieval e monitorando il consumo di contesto. È un promemoria del fatto che la capacità utilizzabile di uno strumento di AI può cambiare senza preavviso e che costruire attorno a un budget di contesto fisso è rischioso.