OpenAI ha reducido discretamente la cantidad de contexto que su herramienta de programación Codex alimenta a GPT-5.6, y los desarrolladores que dependen de largas sesiones agénticas no están satisfechos. La ventana de contexto de entrada configurada por defecto pasó de 372.000 a 272.000 tokens —un recorte de alrededor del 27%— mediante la solicitud de extracción de GitHub #34009.

Qué cambió

La ventana de contexto es la memoria de trabajo de un agente de programación: el tramo de código, instrucciones y conversación previa que el modelo puede retener a la vez. Reducirla en aproximadamente una cuarta parte significa que Codex puede mantener en vista menos partes de una sesión antes de tener que resumir y descartar material anterior, un proceso conocido como compactación.

Por qué lo notaron los desarrolladores

El efecto práctico se deja sentir especialmente en tareas largas y con varios archivos. "Menos memoria por sesión significa que el agente de IA olvida antes partes previas de una larga sesión de programación", dijo el analista Pareekh Jain. Otra, Muskan Bandta, señaló que "muchos desarrolladores dicen que sus sesiones ahora dedican más tiempo a compactar que a trabajar realmente" —la herramienta ocupada gestionando su propia memoria en lugar de escribir código.

Sin explicación oficial

OpenAI no ha explicado públicamente el cambio, dejando a los desarrolladores inferir el motivo. La candidata obvia es el coste: atender una ventana de contexto mayor consume más cómputo por solicitud, por lo que reducirla discretamente abarata la ejecución de Codex a gran escala —el tipo de compromiso que los laboratorios hacen cada vez más a medida que la demanda de inferencia tensiona la capacidad.

Adaptarse a ello

Los analistas dicen que la solución está en el flujo de trabajo, no en la queja. Los equipos deberían "diseñar flujos de trabajo que gestionen proactivamente el contexto", dijo el analista Amit Jena —dividir el trabajo en tareas más pequeñas, recurrir más a mecanismos de recuperación y vigilar el consumo de contexto. Es un recordatorio de que la capacidad utilizable de una herramienta de IA puede cambiar sin previo aviso, y de que construir alrededor de un presupuesto de contexto fijo es arriesgado.