Broadcom 在拉斯维加斯的 VMware Explore 上宣布了 VMware Cloud Foundation 的一组经验证模型,以便企业能在自有硬件上提供 model-as-a-service。被点名的共有五个:Nvidia 的 Nemotron 3、Google DeepMind 的 Gemma 4、NEC 的 cotomi、Alibaba Cloud 的 Qwen 3.7-Max 以及 Z.ai 的 GLM 5.2。
5 和 150 不是同一个说法
这份发布在相邻段落中同时提到了这两个数字,但它们的含义不同。5 个模型是 Broadcom 已在特定配置上测试并验证过的。150 多个则是 vLLM 运行时在技术上可服务的开源模型数量——这只是能力说明,不附带任何厂商担保。把两者视为等同,会把 Broadcom 的承诺夸大 30 倍。
名单上值得注意的名字
5 个经验证模型中有 2 个是中国模型。发布稿将 Qwen 3.7-Max 描述为一款专有多模态模型,拥有 100 万 token 上下文窗口,可用于主权化、本地部署访问;GLM 5.2 则是 Z.ai 的开源通用语言模型,定位于本地编码和推理代理。对于无法把数据发送到公有云的企业而言,这意味着可以在自有硬件上使用中国开源权重模型,并配套一套美国厂商的技术栈。NEC 的日语优化模型 cotomi 也出现在同一名单中,理由相同:主权,而非基准领先。
两个并非衡量结果的数字
这份发布把 MLPerf Inference v5.1 作为一个测量项目来提及。但那指的是一种方法论,而不是已公布的 MLPerf 结果——通告中并没有出现任何性能数据。另一项经常被引用的数字,56% 的企业在私有云中运行生产推理,则来自 Broadcom 自己的 Private Cloud Outlook 2026 调查,而非独立分析机构。
包装传递的信息
在指定硬件上验证一小份固定名单,一直是基础设施厂商销售数据库和虚拟机管理程序的方式:挑选受支持的组合,签下支持合同。把这一逻辑用于模型服务后,企业的选择范围就从“任何 Hugging Face 上的模型”缩小成了“我们会接电话支持的那 5 个”。
