蚂蚁集团的 Ling(百灵)团队于 8 月 27 日 15:58:10 UTC 上线了 Ling-3.0-flash-Fin,时间戳来自为其提供服务的路由层上的创建记录。中文公告则于 8 月 28 日 02:41:40 UTC 发布。该模型是一个针对金融语料调优的混合专家模型:总参数 1240 亿,激活参数 51 亿。
实际发布的内容
一个服务端点,其内部 id 带有厂商自己的日期戳——inclusionai/ling-3.0-flash-fin-20260827:free——在一个声明为 一个月 的窗口内,通过 单一提供商,提示词和补全的价格都为 零。上下文长度为 262,144 个 token,最大补全长度为 32,768。
常见表述哪里说错了
英文报道把这称为开源发布。但今天并不是。 权重尚未公开;蚂蚁称会在“下周”发布,而其 inclusionAI 的 Hugging Face 组织目前根本没有列出 Ling-3.0-flash-Fin 仓库——那里最新的条目还是八天前的 UI-Venus-2-9B 和 Ling-3.0-flash 基础版本。这里的开放权重只是一个带着大致日期的承诺,而不是已经发生的事实。
其次,这些基准成绩是自报数据。智能指数从 38 升到 41 的说法,出自蚂蚁自己的公告材料,而非该指数维护方的独立发布。金融代理评测集合——FinFIRST、FinSearchComp Verified、Finance Agent、APEX-Agents、SpreadsheetBench、τ³-Banking——同样由蚂蚁自行汇总,其中 FinFIRST 是蚂蚁称与 50 多名受聘金融专业人士共同设计的基准。一家厂商在自己设计的基准上得分高,不能比数字本身显示得更有说服力。
第三,参数规模并非新东西。1240 亿总参数和 51 亿激活参数,都是直接沿用 7 月 24 日发布的 Ling-3.0-flash。它是在金融数据上进行持续预训练加后训练,而不是一款新的前沿模型,把它当成前沿模型报道会夸大其意义。还有一点:外界报道上下文长度为“256K”,但实际服务值是 262,144,输出上限为 32,768 token——这对该模型被销售时主打的长报告场景来说,是一个实实在在的限制。
