Il team Ling (百灵) di Ant Group ha messo online Ling-3.0-flash-Fin alle 15:58:10 UTC del 27 agosto, come mostra il record di creazione sul layer di routing che lo serve. L’annuncio in lingua cinese è arrivato in seguito, alle 02:41:40 UTC del 28 agosto. Il modello è un mixture-of-experts addestrato su corpora finanziari: 124 miliardi di parametri totali, 5,1 miliardi attivi.

Cosa è stato davvero rilasciato

Un solo endpoint di serving, il cui id interno riporta la data del vendor — inclusionai/ling-3.0-flash-fin-20260827:free — con prompt e completion entrambi a prezzo zero per una finestra dichiarata di un mese, tramite un singolo provider. La lunghezza del contesto è di 262.144 token, con una completion massima di 32.768.

Cosa non torna nel framing più diffuso

La copertura in inglese lo definisce un rilascio open source. Oggi non lo è. I pesi non sono stati resi disponibili; Ant dice "la prossima settimana" e la sua organizzazione Hugging Face inclusionAI non elenca al momento alcun repository Ling-3.0-flash-Fin — le voci più recenti sono UI-Venus-2-9B e varianti base di Ling-3.0-flash di otto giorni fa. Gli open weights, qui, sono una promessa con una data approssimativa, non un evento già avvenuto.

Secondo punto, i numeri dei benchmark sono auto-riportati. La salita da 38 a 41 su un indice di intelligenza compare nel materiale di annuncio di Ant, non in una pubblicazione indipendente dei manutentori dell’indice. Anche la batteria sui finance agent — FinFIRST, FinSearchComp Verified, Finance Agent, APEX-Agents, SpreadsheetBench, τ³-Banking — è di Ant, e FinFIRST è un benchmark che Ant descrive come progettato con oltre 50 professionisti della finanza da essa reclutati. Un vendor che ottiene buoni risultati su un benchmark costruito dal vendor stesso è una prova più debole di quanto il numero faccia pensare.

Terzo, i conteggi dei parametri non sono nuovi. I 124B totali e i 5,1B attivi derivano senza modifiche da Ling-3.0-flash, rilasciato il 24 luglio. Si tratta di un continued-pretrain più post-train su dati finanziari, non di un nuovo modello di frontiera, e la copertura che lo tratta come tale lo sovrastima. Dettaglio non secondario: il contesto viene riportato come "256K", ma il valore effettivamente servito è 262.144 con un tetto di output di 32.768 token — un vincolo concreto per il caso d’uso di report lunghi per cui il modello viene venduto.