La documentación para desarrolladores de OpenAI sobre GPT-6 Astra incluye una regla de precios que la mayor parte de la cobertura del lanzamiento pasó por alto, y que invierte la economía exacta de las cargas de trabajo para las que se vende el modelo. El precio anunciado de 10 dólares por millón de tokens de entrada y 50 dólares por millón de salida solo se mantiene por debajo de un umbral, y más allá de él toda la solicitud se vuelve a tarificar.
El umbral se aplica a todo, no al exceso
La página del modelo lo dice sin rodeos: "Prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request." Las palabras for the full request son las que marcan el coste. Un prompt de 273.000 tokens no se factura a la tarifa estándar con un recargo sobre los últimos mil tokens: todo él se vuelve a tarificar, hasta 20 dólares de entrada y 75 de salida. Un prompt dos mil tokens más corto cuesta la mitad.
Las escrituras en caché cuestan más que la entrada nueva
La misma tabla fija el precio de la entrada en caché en 1,00 dólar por millón y las escrituras en caché en 12,50 dólares; la página señala que las escrituras se facturan a 1,25x la tarifa de entrada sin caché. El almacenamiento en caché de prompts suele presentarse como un ahorro; aquí es una prima inicial que solo se amortiza con la reutilización. Batch y Flex funcionan a la mitad de la tarifa estándar; el modo Fast funciona al doble, y la página añade que el modo Fast "is unavailable for GPT-6 Astra with EU data residency."
Controles que el modelo ya no acepta
El changelog de OpenAI enumera las limitaciones: sin compatibilidad con el nivel de none de reasoning effort, sin temperature ni top_p personalizadas, y sin logprobs. No se trata de un recorte de parámetros poco usados. Los entornos de evaluación, las canalizaciones de clasificadores y cualquier cosa que trabaje con probabilidades de tokens no pueden portarse a Astra en absoluto, digan lo que digan sus resultados de benchmark.
Qué falla en el encuadre recibido
Los rastreadores y las notas publican 10/50 dólares fijos para un modelo de un millón de tokens. Ambas mitades inducen a error. El precio se aplica al caso de contexto corto, mientras que las ejecuciones agénticas y de uso del ordenador —las que OpenAI promociona para Astra— viven por encima del umbral y son un modelo de 20/75 dólares. Y la cifra de "1M context" es la ventana de contexto de 1.050.000 tokens que figura en la página, y que incluye margen para generación; con 128.000 tokens máximos de salida también indicados allí, la entrada utilizable se sitúa en torno a 922.000. OpenAI no publica esa resta, y cualquiera que dimensione una canalización de documentos a partir de "1M input" se equivoca en unos 128K.
