L’équipe Qwen d’Alibaba a mis en ligne sur ModelScope un compte à rebours qui s’engage à ouvrir deux artefacts — Qwen/Qwen3.8-Flash-Next et une variante FP8 — à un moment précis. Le champ lisible par machine est sans ambiguïté : "ReleaseDate": "2026-08-26T15:00:00.000Z", soit 23 h 00, heure de Pékin, le 26 août. C’est l’intégralité de l’engagement écrit pris par Alibaba.
Ce que l’annonce dit réellement
Qwen décrit le modèle uniquement comme un modèle MoE multimodal construit sur l’architecture Qwen4 de nouvelle génération. Le texte chinois le présente comme un aperçu d’architecture — quelque chose de publié afin que les moteurs d’inférence puissent se préparer à une famille Qwen4 qui est 即将推出, à venir. Les artefacts prévus sont les poids de base ainsi qu’une quantification FP8.
Ce que le cadrage courant ignore
Les articles publiés au cours de la dernière journée se sont arrêtés sur une fiche technique précise : 125 milliards de paramètres au total, 51 milliards de paramètres N-gram, 6 milliards actifs et un nouveau schéma d’attention clairsemée. À la lecture du document officiel, champ par champ, rien de tout cela n’y figure. Il n’y a aucun nombre de paramètres. Il n’y a aucun tableau de benchmarks. Le champ License est vide — ce qui, pour une publication en « open-weights », est le blanc le plus lourd de conséquences sur la page. Ces chiffres renvoient à une fiche modèle publiée puis supprimée, ainsi qu’à un compte social tiers. La contradiction est visible dans la couverture elle-même : au moins un flash largement diffusé affiche à la fois 60B et 6B paramètres actifs sur la même page — un facteur dix — tout en admettant que les chiffres ne sont pas confirmés.
Pourquoi une fiche provisoire supprimée n’est pas une source
Les annonces préliminaires sur les plateformes de modèles sont régulièrement modifiées : les équipes préparent une fiche, révisent la description de l’architecture, puis republient. Une fiche qui a existé quelques heures avant d’être retirée est un brouillon, pas une divulgation. La traiter autrement revient à publier une architecture qu’Alibaba n’a pas revendiquée, sur un modèle que personne en dehors de l’entreprise n’a exécuté.
Ce qu’il faudra surveiller à 15:00 UTC
Deux éléments seront clarifiés dès l’arrivée des poids : la licence, et le fait que « Flash-Next » soit une simple mise à jour de Qwen3.x ou bien, réellement, le premier élément public de Qwen4. Tout le reste actuellement en circulation reste provisoire.
