Google a rendu Gemini 3.8 Flash généralement disponible le 2 septembre, troisième version Flash en six semaines, aux côtés d’un modèle associé orienté sécurité, baptisé 3.8 Flash Cyber. Le billet de lancement promet des « améliorations significatives par rapport à 3.7 Flash dans l’ingénierie logicielle, les tâches agentiques et le raisonnement critique à plusieurs étapes dans des domaines spécialisés ». Le document de sécurité publié en parallèle dit pratiquement l’inverse.
Ce que dit réellement le model card
Le model card de DeepMind indique que les évaluations de Google « n’ont trouvé aucun niveau de capacité suivie ou critique atteint », et affirme textuellement que Gemini 3.8 Flash « n’a pas de nouvelles capacités significatives ni d’augmentation matérielle des performances » dans les domaines définis par le Frontier Safety Framework, par rapport à Gemini 3.7 Flash. Cette phrase n’est pas une critique dissimulée par un examinateur. C’est la conclusion déterminante : c’est précisément parce que le modèle ne progresse pas sur ces axes qu’il satisfait au cadre et peut être déployé.
Le prix est une promotion, pas un prix
3.8 Flash arrive à 0,75 $ par million de jetons d’entrée et 3,75 $ par million de jetons de sortie — le même tarif que 3.7 Flash. Le billet de lancement présente ce montant comme un tarif introductif et précise son échéance : le taux prend fin le 31 décembre 2026, et à partir du 1er janvier 2027, le modèle coûtera 1,50 $ et 7,50 $. Quiconque modélise l’économie unitaire à partir de la page d’aujourd’hui la projette sur quatre mois, après quoi les mêmes jetons coûteront deux fois plus cher.
Ce que le cadrage courant comprend mal
La couverture a lu les deux documents comme s’ils décrivaient des sujets différents — le marketing d’un côté, le langage administratif de conformité de l’autre. Ils décrivent pourtant le même modèle, et ils ne sont pas en contradiction dès lors qu’on lit ce que chacun mesure. Le billet de lancement parle de performances sur des benchmarks de codage et de travail agentique. Le model card parle de seuils de capacités dangereuses. Un modèle peut devenir sensiblement meilleur pour écrire du logiciel sans progresser sur les éléments qu’un cadre de sécurité est conçu pour détecter, et c’est ce que Google dit s’être produit ici. L’erreur consiste à interpréter « validé par le Frontier Safety Framework » comme un gage de capacité. C’est l’inverse.
Pourquoi un troisième Flash en six semaines
Le rythme compte davantage que l’incrément. Flash est la gamme qui porte le trafic de production, et Google la révise désormais plus vite que la plupart des clients ne peuvent mener un cycle d’évaluation complet. Une équipe qui a évalué 3.7 Flash en juillet se voit demander de revalider un modèle dont la propre documentation de sécurité indique que le profil de capacités n’a pas évolué de manière significative — tandis que le prix introductif qui justifiait la migration arrive avec une date de fin ferme.
