OpenAI가 Codex 코딩 도구가 GPT-5.6에 제공하는 컨텍스트 양을 조용히 줄였고, 장시간 에이전틱 세션에 의존하는 개발자들은 불만을 드러내고 있습니다. 기본 설정 입력 컨텍스트 윈도는 GitHub pull request #34009를 통해 372,000토큰에서 272,000토큰으로, 약 27% 줄었습니다.
무엇이 바뀌었나
컨텍스트 윈도는 코딩 에이전트의 작업 기억으로, 모델이 한 번에 유지할 수 있는 코드, 지시사항, 이전 대화의 범위를 뜻합니다. 이를 약 4분의 1가량 줄이면 Codex는 세션의 더 적은 부분만 시야에 둘 수 있고, 그보다 앞선 자료는 요약해 버려야 합니다. 이 과정은 compaction으로 알려져 있습니다.
개발자들이 이를 알아차린 이유
실질적인 영향은 장시간의 다중 파일 작업에서 가장 크게 나타납니다. 분석가 Pareekh Jain은 "세션당 메모리가 적다는 것은 AI 에이전트가 긴 코딩 세션의 앞부분을 더 빨리 잊는다는 뜻"이라고 말했습니다. 또 다른 분석가 Muskan Bandta는 "많은 개발자들이 이제 세션이 실제 작업보다 압축에 더 많은 시간을 쓰고 있다고 말하고 있다"고 지적했습니다. 즉, 도구가 코드를 쓰는 대신 자신의 메모리를 관리하느라 바쁘다는 뜻입니다.
설명된 이유는 없음
OpenAI는 이 변경을 공개적으로 설명하지 않았으며, 개발자들은 그 동기를 추정할 수밖에 없습니다. 가장 유력한 후보는 비용입니다. 더 큰 컨텍스트 윈도를 제공하려면 요청당 더 많은 연산 자원이 들기 때문에, Codex를 대규모로 운영하는 비용을 낮추려는 조용한 축소라는 해석입니다. 추론 수요가 용량을 압박하면서 연구소들이 점점 더 자주 택하는 절충안이기도 합니다.
대응 방법
분석가들은 해법은 불만이 아니라 워크플로에 있다고 말합니다. 팀은 "컨텍스트를 능동적으로 관리하는 워크플로를 설계해야 한다"고 분석가 Amit Jena는 말했습니다. 즉, 작업을 더 작은 단위로 나누고, 검색 메커니즘에 더 많이 의존하며, 컨텍스트 소비를 모니터링해야 한다는 것입니다. 이는 AI 도구의 실사용 용량이 예고 없이 바뀔 수 있으며, 고정된 컨텍스트 예산을 전제로 구축하는 것은 위험하다는 점을 상기시킵니다.
