Alibaba、Tencent、Meituan 和 HSG 支持的北京实验室 Moonshot AI,于 7 月 16 日 发布了 Kimi K3——这是一款 2.8 万亿参数 的稀疏混合专家模型,该公司称其为有史以来规模最大的开源模型。该模型已立即在 Kimi.com 和 API 上线;模型权重则承诺于 7 月 27 日 发布,因此就目前而言,K3 仍是一款“等待中的”开放权重模型。

架构

K3 每次查询仅激活 896 个专家中的 16 个,并拥有 100 万 token 的上下文窗口。两项内部开发的组件承担了主要计算:Kimi Delta Attention,一种混合线性注意力机制,Moonshot 称其在百万 token 长度下可实现最高 6.3 倍 的解码速度;以及 Attention Residuals,该实验室将其视为残差连接的即插即用替代方案,并称其带来了稳定的扩展收益。推理始终开启:API 只提供 reasoning_effort 的最大设置,无法关闭思考。

成绩榜

GDPval-AA v2 上,这项基准衡量 44 个职业和 9 个行业中的真实世界任务,K3 得分 1,687,总排名第三,仅次于 Anthropic 的 Claude Fable 5 Max(1,815)和 OpenAI 的 GPT-5.6 Sol Max(1,747.8),高于 Claude Opus 4.8(1,600)。它在 AA-Briefcase 上也以 1,527 位列第二。Fortune 的评价直截了当:这次发布将中国 AI 推入了其所称的 Fable 级别区间。

效率即战略

Moonshot 总裁张雨桐将这一设计定义为约束条件的产物:“我们知道自己没有奢侈到可以单纯扩大算力。这迫使我们把重点放在基础研究和效率上。”API 定价为每百万条缓存命中输入 token $0.30、缓存未命中输入 $3.00、输出 $15.00——较西方前沿模型价格大幅更低。

时机至关重要

这次发布恰逢上海世界人工智能大会前夕。该大会于 7 月 17 日开幕,习近平出席并发表主旨演讲。与此同时,据报道 Moonshot 正在以 315 亿美元估值融资,而在 7 月 27 日权重真正公布之前,公司对“最大开源模型”的说法仍带有一个星号。