L'équipe Ling (百灵) d'Ant Group a mis en ligne Ling-3.0-flash-Fin à 15:58:10 UTC le 27 août, horodaté par l'enregistrement de création sur la couche de routage qui le dessert. L'annonce en chinois a suivi à 02:41:40 UTC le 28 août. Le modèle est un mélange d'experts ajusté sur des corpus financiers : 124 milliards de paramètres au total, 5,1 milliards actifs.
Ce qui a réellement été publié
Un point de service unique, dont l'identifiant interne porte le propre horodatage du fournisseur — inclusionai/ling-3.0-flash-fin-20260827:free — avec un prix de zéro pour le prompt et la complétion pendant une fenêtre annoncée d'un mois, via un seul fournisseur. La longueur de contexte est de 262 144 tokens, avec une complétion maximale de 32 768.
Ce que le cadrage habituel présente mal
La couverture anglophone présente cette sortie comme un lancement open source. Ce n'est pas le cas, à ce jour. Les poids n'ont pas été publiés ; Ant dit « la semaine prochaine », et son organisation Hugging Face inclusionAI n'affiche actuellement aucun dépôt Ling-3.0-flash-Fin — les entrées les plus récentes sont UI-Venus-2-9B et des variantes de base de Ling-3.0-flash datant d'il y a huit jours. Des poids ouverts ici relèvent d'une promesse assortie d'une date approximative, pas d'un événement déjà survenu.
Deuxièmement, les chiffres des benchmarks sont auto-déclarés. La progression de 38 à 41 sur un indice d'intelligence figure dans le matériel d'annonce d'Ant lui-même, et non dans une publication indépendante des mainteneurs de l'indice. L'évaluation des agents financiers — FinFIRST, FinSearchComp Verified, Finance Agent, APEX-Agents, SpreadsheetBench, τ³-Banking — est elle aussi propre à Ant, et FinFIRST est un benchmark qu'Ant dit avoir conçu avec plus de 50 professionnels de la finance qu'il a recrutés. Le fait qu'un fournisseur obtienne de bons scores sur un benchmark qu'il a lui-même construit est une affirmation plus faible que ne le suggère le chiffre.
Troisièmement, les comptes de paramètres ne sont pas nouveaux. Les 124B au total et les 5,1B actifs sont repris à l'identique de Ling-3.0-flash, publié le 24 juillet. Il s'agit d'un pré-entraînement continu suivi d'un post-entraînement sur des données financières, pas d'un nouveau modèle de pointe, et le traitement qui en est fait dans la couverture le surévalue. Détail supplémentaire : la longueur de contexte est souvent rapportée comme « 256K », mais la valeur servie est 262 144 avec un plafond de sortie de 32 768 tokens — une contrainte réelle pour le cas d'usage de longs rapports auquel le modèle est destiné.
