OpenAI a discrètement réduit la quantité de contexte que son outil de codage Codex transmet à GPT-5.6, au grand mécontentement des développeurs qui s’appuient sur de longues sessions agentiques. La fenêtre de contexte d’entrée configurée par défaut est passée de 372,000 à 272,000 tokens — soit une baisse d’environ 27% — via la pull request GitHub #34009.
Ce qui a changé
La fenêtre de contexte est la mémoire de travail d’un agent de codage : l’étendue du code, des instructions et des conversations précédentes que le modèle peut conserver d’un seul tenant. La réduire d’environ un quart signifie que Codex peut garder moins d’une session à l’esprit avant de devoir résumer et écarter des éléments plus anciens — un processus appelé compaction.
Pourquoi les développeurs l’ont remarqué
L’effet pratique se fait le plus sentir sur les tâches longues et multi-fichiers. « Moins de mémoire par session signifie que l’agent IA oublie plus tôt des parties d’une longue session de codage », a déclaré l’analyste Pareekh Jain. Une autre, Muskan Bandta, a noté que « beaucoup de développeurs disent désormais que leurs sessions passent plus de temps à compacter qu’à réellement travailler » — l’outil occupé à gérer sa propre mémoire plutôt qu’à écrire du code.
Aucune justification avancée
OpenAI n’a pas expliqué publiquement ce changement, laissant les développeurs en déduire le motif. Le candidat le plus évident est le coût : servir une fenêtre de contexte plus grande consomme plus de calcul par requête, donc la réduire discrètement abaisse le coût d’exploitation de Codex à grande échelle — le type de compromis que les laboratoires font de plus en plus à mesure que la demande en inférence pèse sur les capacités.
S’adapter à cette contrainte
Les analystes estiment que la solution relève du flux de travail, pas de la plainte. Les équipes devraient « concevoir des flux de travail qui gèrent le contexte de manière proactive », a déclaré l’analyste Amit Jena — en découpant le travail en tâches plus petites, en s’appuyant davantage sur les mécanismes de récupération et en surveillant la consommation de contexte. C’est un rappel que la capacité utile d’un outil d’IA peut évoluer sans préavis, et qu’il est risqué de construire autour d’un budget de contexte fixe.
