L’17 agosto si è diffusa ampiamente la notizia che il prezzo di GPT-5.6 Sol fosse stato dimezzato. È solo parzialmente vero, ma in modo importante per chi deve pianificare i costi dell’inferenza. OpenRouter sta offrendo il modello a $2.50 per 1M di token in input e $15 per 1M in output, con un badge di sconto del 50% accanto ai prezzi barrati di $5.00 e $30.00. Quei valori barrati restano i prezzi reali di OpenAI.

Cosa dicono le due schede prezzi

La pagina dei prezzi per sviluppatori di OpenAI, verificata direttamente, indica GPT-5.6 Sol a $5.00 in input e $30.00 in output per milione di token. A titolo di riferimento, la stessa pagina riporta Terra a $2.00/$12.00 e Luna a $0.20/$1.20. Non viene menzionato alcuno sconto o promozione. Le uniche strutture tariffarie speciali pubblicate da OpenAI sono quelle standard: i livelli batch, flex e fast, le tariffe per input memorizzato nella cache e un sovrapprezzo del 10% per gli endpoint di elaborazione regionali.

Dove sbaglia l’inquadramento comune

«OpenAI taglia del 50% i prezzi di GPT-5.6 Sol» è falso per portata e probabilmente per durata. Per portata: si tratta di una promozione su un gateway, non di una modifica al prezzo di listino del modello. Chi chiama direttamente l’API di OpenAI, o passa per qualsiasi altro canale, continua a pagare $5 e $30: nulla nel costo del modello è cambiato. Per durata: la pagina di OpenRouter mostra lo sconto ma indica nessuna data di fine, e la promozione non compare nella pagina annunci di OpenRouter. Uno sconto senza scadenza pubblicata non è una riprezzatura, e una previsione di spesa basata su $2.50/$15 incorpora una soglia di uscita sconosciuta.

Perché uno sconto si collocherebbe sul gateway

I gateway sono il punto in cui gli acquirenti confrontano davvero i prezzi. Uno sviluppatore che sceglie un modello su un aggregatore vede Sol accanto a tutti i concorrenti, con il costo per token indicato a fianco di ciascuno; uno sviluppatore che legge la documentazione di OpenAI non lo vede. Applicare uno sconto nel luogo in cui avviene la sostituzione consente di guadagnare quota nel momento della decisione, lasciando però invariato il prezzo pubblicato — il numero a cui si ancorano i contratti enterprise e i modelli degli analisti.

La conseguenza per la curva dei costi

La tesi standard secondo cui i costi dell’inferenza scendono di una certa percentuale all’anno si calcola sui prezzi di listino. Se il prezzo effettivo della transazione dipende sempre più dal canale attraverso cui viene instradata una richiesta e dalle promozioni attive in quel mese, il prezzo di listino smette di essere una misura affidabile di qualsiasi cosa. Due sviluppatori che eseguono carichi di lavoro identici sullo stesso modello possono ora pagare importi diversi in misura doppia, e nessuno dei due prezzi è sbagliato.