Une affirmation selon laquelle GPT-5.6 Sol aurait été divisé par deux en prix a largement circulé le 17 août. Elle est à moitié vraie, d’une manière qui compte pour quiconque budgète l’inférence. OpenRouter propose le modèle à 2,50 $ par 1 M de tokens d’entrée et 15 $ par 1 M de tokens de sortie, avec un badge de remise de 50 % affiché à côté de prix barrés de 5,00 $ et 30,00 $. Ces montants barrés restent les vrais prix d’OpenAI.
Ce que disent les deux grilles tarifaires
La page de tarification développeur d’OpenAI, consultée directement, indique GPT-5.6 Sol à 5,00 $ en entrée et 30,00 $ en sortie par million de tokens. À titre de comparaison, la même page affiche Terra à 2,00 $/12,00 $ et Luna à 0,20 $/1,20 $. Elle ne mentionne ni remise ni promotion. Les seules structures tarifaires spéciales publiées par OpenAI sont les suivantes : les paliers standard batch, flex et fast, les tarifs sur entrée mise en cache, ainsi qu’une majoration de 10 % pour les points d’accès de traitement régionaux.
Ce que l’interprétation courante a d’erroné
« OpenAI baisse de 50 % les prix de GPT-5.6 Sol » est faux dans son périmètre, et probablement dans sa durée. Dans son périmètre : il s’agit d’une promotion sur une passerelle, pas d’une modification du prix catalogue du modèle. Toute personne qui appelle directement l’API d’OpenAI, ou via toute autre voie, paie toujours 5 $ et 30 $ — rien n’a changé dans le coût du modèle. Dans sa durée : la page d’OpenRouter affiche la remise mais indique aucune date de fin, et la promotion n’apparaît pas sur la page d’annonces d’OpenRouter. Une remise sans échéance publiée n’est pas un ajustement de prix, et un prévisionnel de dépenses fondé sur 2,50 $/15 $ comporte une échéance inconnue.
Pourquoi une remise se situerait à la passerelle
Les passerelles sont l’endroit où les acheteurs comparent réellement les prix. Un développeur qui choisit un modèle sur un agrégateur voit Sol à côté de tous ses concurrents, avec le coût par token affiché à côté de chacun ; un développeur qui lit la documentation d’OpenAI ne le voit pas. Accorder une remise là où s’opère la substitution permet de gagner des parts au moment de la décision, tout en laissant inchangé le prix publié — le chiffre auquel sont arrimés les contrats entreprise et les modèles d’analystes.
La conséquence pour la courbe des coûts
La formule classique selon laquelle les coûts d’inférence baissent d’un certain pourcentage par an est calculée à partir des prix catalogue. Si le prix réel d’une transaction dépend de plus en plus de l’itinéraire emprunté par la requête et des promotions actives ce mois-là, le prix catalogue cesse d’être une mesure fiable de quoi que ce soit. Deux développeurs exécutant des charges de travail identiques sur le même modèle peuvent désormais payer des montants deux fois différents, et aucun des deux prix n’est faux.
