Zhipu a ouvert l’accès API à GLM-5.3 dans les petites heures du 19 août heure de Chine, le Securities Times l’ayant signalé à 10:37 CST — 02:37 UTC. L’entreprise revendique un score de 60 sur l’Artificial Analysis Intelligence Index, qu’elle décrit comme une entrée dans la catégorie de pointe et un rapprochement avec des modèles propriétaires phares comme Claude Fable 5 et GPT-5.6 Sol.

Les revendications

Les tarifs de l’API sont donnés comme inchangés par rapport à GLM-5.2. Zhipu attribue l’amélioration presque entièrement au post-training sur la même base que son prédécesseur plutôt qu’à un modèle plus grand. La documentation indique un contexte de 1M tokens et une sortie maximale de 128K.

Ce que le récit courant présente mal

GLM-5.3 est déjà décrit comme le principal modèle ouvert, ou à égalité pour cette place. Ce n’est pas encore un modèle ouvert, car il n’existe aucun poids. Nous avons interrogé directement l’API HuggingFace plutôt que de l’accepter sur parole : l’organisation zai-org n’a aucun dépôt GLM-5.3, et ses poids publiés les plus récents restent GLM-5.2, modifiés pour la dernière fois le 2 juillet. Ce qui a été lancé cette semaine est une API hébergée et une offre d’abonnement. L’entreprise affirme que les poids suivront le 28 août.

Cette distinction est ici plus importante qu’à l’accoutumée, car un classement open-weights qui crédite un modèle que personne ne peut télécharger mesure une promesse. C’est aussi une promesse qui a déjà changé une fois : lors du lancement de GLM-5.2 le 14 août, les poids devaient arriver « d’ici deux semaines ». Et aucune licence n’a été précisée — « open weights » recouvre aussi bien Apache 2.0 qu’une licence sur mesure interdisant l’usage commercial, et celle qui s’applique n’est pas encore publique.

Le prix invérifiable

« Tarifs inchangés » ne peut pas non plus être vérifié. Aucun montant par jeton n’a été publié en même temps que cette affirmation, et l’offre de codage associée repose sur un quota de points avec remise hors heures creuses plutôt que sur une grille tarifaire simple. Une allocation de points peut être revalorisée sans qu’aucun chiffre publié ne change.

Pourquoi cette séquence est délibérée

Lancer d’abord l’API, puis les poids neuf jours plus tard, permet de capter la couverture des benchmarks et le trafic API payant pendant que l’attention dure, puis de publier les poids dans un cycle médiatique déjà passé à autre chose. C’est une séquence rationnelle — mais cela signifie que le titre et l’artefact arrivent à des jours différents, et qu’un seul des deux peut actuellement être vérifié.