A equipe Ling (百灵) do Ant Group colocou o Ling-3.0-flash-Fin no ar às 15:58:10 UTC de 27 de agosto, horário registrado pelo histórico de criação na camada de roteamento que o atende. O anúncio em chinês veio depois, às 02:41:40 UTC de 28 de agosto. O modelo é um mixture-of-experts ajustado em corpora financeiros: 124 bilhões de parâmetros no total, 5,1 bilhões ativos.
O que de fato foi lançado
Um único endpoint de atendimento, cujo id interno carrega a própria marca temporal do fornecedor — inclusionai/ling-3.0-flash-fin-20260827:free — com prompt e completion ambos precificados em zero por uma janela declarada de um mês, por meio de um único provedor. O tamanho de contexto é de 262.144 tokens, com conclusão máxima de 32.768.
O que a leitura comum erra
A cobertura em inglês está chamando isso de lançamento open source. Não é, no momento. Os pesos ainda não foram liberados; a Ant diz "na próxima semana", e sua organização inclusionAI no Hugging Face atualmente não lista nenhum repositório Ling-3.0-flash-Fin — as entradas mais recentes ali são UI-Venus-2-9B e variantes base do Ling-3.0-flash de oito dias atrás. Pesos abertos, aqui, são uma promessa com data aproximada, não um fato consumado.
Segundo, os números de benchmark são autorrelatados. A alta de 38 para 41 em um índice de inteligência aparece no próprio material de anúncio da Ant, não em uma publicação independente dos mantenedores do índice. O conjunto de testes para agentes financeiros — FinFIRST, FinSearchComp Verified, Finance Agent, APEX-Agents, SpreadsheetBench, τ³-Banking — também é da própria Ant, e FinFIRST é um benchmark que a Ant diz ter desenhado com mais de 50 profissionais do setor financeiro recrutados por ela. Um fornecedor com bom desempenho em um benchmark criado pelo próprio fornecedor é uma afirmação mais fraca do que o número sugere.
Terceiro, os números de parâmetros não são novos. 124 bilhões no total e 5,1 bilhões ativos são herdados inalterados do Ling-3.0-flash, lançado em 24 de julho. Trata-se de um continued-pretrain mais pós-treinamento em dados financeiros, não de um novo modelo de fronteira, e a cobertura que o trata assim o infla. Um ponto menor: o contexto vem sendo reportado como "256K", mas o valor servido é 262.144, com um teto de saída de 32.768 tokens — uma restrição real para o caso de uso de relatórios longos que o modelo pretende atender.
