Alibaba 的 Qwen 团队于 8 月 14 日发布了 Qwen3.8-27B 的权重,并在 Hugging Face 和 ModelScope 上以 Apache 2.0 许可形式开放。
这个模型是什么
这是一款 270 亿参数的稠密视觉语言模型——不是混合专家模型——可处理文本、图像和长达数小时的视频。其架构在 64 层上采用混合设计:16 个由 3 层 Gated DeltaNet 组成的模块将信息送入网络,每个模块后接一个 Gated Attention 模块。原生上下文长度为 262,144 个 token,借助 YaRN 可扩展到约 100 万个 token,并且可关闭思考模式。
主张
Qwen 表示,这款 27B 模型在编码和办公任务上的表现优于体量大得多的 Qwen3.7-Plus。其模型卡显示,SWE-bench Pro 61.7、Terminal Bench 2.1 73.0、OSWorld-Verified 84.3、GPQA Diamond 89.2、在代码解释器加持下的 MathVision 为 94.6,CharXiv 为 90.2。
要准确理解许可协议
这里的 Apache 2.0 是实打实的:权重可下载,也可在商业场景中使用,无需定制许可。但训练数据和训练代码并未公开,因此这属于开放权重,而非开源——对于需要审计模型学到了什么,而不仅仅是运行模型的人来说,这一区别至关重要。
基准成绩也要同样看待
上面的每一项数据都由 Alibaba 在其自家模型卡中自报,目前尚无独立复现。一个小型稠密模型击败更大的同类模型,恰恰是那种在第三方评测下往往会缩水的比较,因为厂商同时决定测试框架和基线。官方 API 标注为“即将推出”,并承诺会在 Qwen Cloud 上提供一个支持 100 万 token 上下文的托管版本。
这里真正的新意是什么
Qwen 3.8 这个名字并不新。它在 7 月就已用于闭源的 Qwen3.8-Max,而更大的开放权重 Qwen3.8-2.4T-A95B 混合专家模型也在两天前发布。真正的新消息是,这个系列中体量较小、稠密、可在本地运行的层级如今已经上线——而这正是大多数人真正能够部署的层级。
