OpenAI는 목요일 API 가격을 조정하며 이례적인 설명을 덧붙였습니다. 자사 최전선 모델이 프로덕션에서 모델을 서빙하는 커널을 다시 썼다고 회사는 밝혔습니다.
가격
백만 토큰당 GPT-5.6 Luna는 이제 입력 $0.20 / 출력 $1.20로, 7월 9일 출시 당시의 $1와 $6에서 내려와 80% 인하됐습니다. Terra는 20% 내려 입력 $2, 출력 $12가 됐습니다. 캐시된 입력은 양쪽 모두 미스 가격의 10분의 1로 처리됩니다. Luna는 이제 Gemini 3.1 Flash-Lite보다 낮고, 입력 가격 기준으로 Claude Haiku 4.5의 약 5분의 1 수준입니다.
플래그십은 변동이 없었습니다
헤드라인은 "OpenAI가 가격을 최대 80% 인하"로 수렴했습니다. Sol은 오늘도 입력 $5 / 출력 $30이며 출시 당시에도 $5 / $30였습니다 — 0% 인하입니다. 80% 인하는 패밀리에서 가장 작은 모델에만 적용됩니다. Axios는 스스로 모순되는 헤드라인 "OpenAI discounts GPT-5.6 Luna and Terra, but not Luna."를 만들어냈습니다.
인과 설명은 거꾸로 제시됐습니다
OpenAI의 변경 로그에는 "with Codex, GPT-5.6 Sol autonomously rewrote and optimized our production kernels"라고 적혀 있으며, 이는 Triton과 Gluon에서 이뤄졌고, 엔드투엔드 서빙 비용을 20% 줄이고 speculative decoding을 통해 토큰 생성 효율을 15% 넘게 끌어올렸다고 합니다. 일부 보도는 이를 "Sol rewrote its own inference stack to fund the price drop"으로 바꿔 썼습니다. 20%의 비용 절감으로는 80% 가격 인하를 감당할 수 없습니다. Luna 가격 재조정은 Google과 Anthropic에 맞선 경쟁적 조치이며, 커널 작업은 별개의 — 그리고 논란의 여지 없이 더 중요한 — 주장입니다. "Autonomously"에도 무게가 실립니다. 표현은 "with Codex"인데, 이는 프로덕션에 들어가기 전 사람이 검토하는 에이전트형 하네스입니다.
Fast 모드는 일률적인 2배 인상입니다
Priority Processing은 사라지고 Fast 모드로 대체됐으며, priority로 표시된 요청은 자동으로 이관됩니다. Fast 모드는 Sol, Terra, Luna 모두에서 표준 요금의 정확히 2배입니다. 변경 로그는 Sol에 한해 "최대 2.5배 더 빠르다"고 입증합니다. Terra와 Luna에는 100%의 할증이 붙지만, 공개된 속도 수치는 없습니다.
