Zhipu ha aperto l'accesso API a GLM-5.3 nelle prime ore del 19 agosto, ora cinese, con Securities Times che ne ha dato notizia alle 10:37 CST — 02:37 UTC. L'azienda rivendica un punteggio di 60 nell'Artificial Analysis Intelligence Index, che descrive come ingresso nella fascia frontier e avvicinamento ai modelli di punta closed, tra cui Claude Fable 5 e GPT-5.6 Sol.
Le rivendicazioni
Il prezzo dell'API è indicato come invariato rispetto a GLM-5.2. Zhipu attribuisce il miglioramento quasi interamente al post-training sullo stesso base model del predecessore, più che a un modello più grande. La documentazione indica un contesto da 1M token e un output massimo di 128K.
Ciò che la narrazione comune sbaglia
GLM-5.3 viene già descritto come il principale open model, o come pari merito. Non è ancora un open model, perché non esistono i pesi. Abbiamo interrogato direttamente l'API di HuggingFace invece di prenderlo per buono: l'organizzazione zai-org non ha alcun repository GLM-5.3, e i suoi pesi pubblicati più recenti sono ancora GLM-5.2, modificati l'ultima volta il 2 luglio. Ciò che è stato rilasciato questa settimana è un'API ospitata e un piano in abbonamento. L'azienda afferma che i pesi arriveranno il 28 agosto.
Questa distinzione qui conta più del solito, perché una classifica open-weights che accredita un modello che nessuno può scaricare sta misurando una promessa. È anche una promessa che si è già spostata una volta: al lancio di GLM-5.2 del 14 agosto, si disse che i pesi sarebbero arrivati "entro due settimane". E non è stata indicata alcuna licenza — "open weights" può andare da Apache 2.0 a una licenza personalizzata che vieta l'uso commerciale, e quale sia applicabile non è ancora pubblico.
Il prezzo non verificabile
Anche "prezzi invariati" non può essere verificato. Nessun dato per token è stato pubblicato insieme alla rivendicazione, e il piano di coding associato è una quota di punti con sconto nelle ore di bassa richiesta anziché una semplice tariffa standard. Un'allocazione di punti può essere ricalibrata senza che cambi alcun numero pubblicato.
Perché la sequenza è deliberata
Lanciare prima l'API e i pesi nove giorni dopo consente di catturare la copertura dei benchmark e il traffico API pagante finché l'attenzione dura, per poi rilasciare i pesi in un ciclo di notizie che si è già spostato altrove. È una sequenza razionale — ma significa che il titolo e l'oggetto arrivano in giorni diversi, e solo uno dei due può essere verificato al momento.
