Broadcom на VMware Explore в Лас-Вегасе объявила о наборе validated models для VMware Cloud Foundation, чтобы компании могли предлагать model-as-a-service на собственном оборудовании. Названы пять моделей: Nemotron 3 от Nvidia, Gemma 4 от Google DeepMind, cotomi от NEC, Qwen 3.7-Max от Alibaba Cloud и GLM 5.2 от Z.ai.

Пять и 150 — это не одно и то же

В релизе эти две цифры стоят в соседних абзацах, но обозначают разные вещи. Пять моделей были протестированы и подтверждены Broadcom на конкретных конфигурациях. Более 150 — это количество open-source-моделей, которые технически может обслуживать runtime vLLM, то есть это характеристика возможностей без какой-либо гарантии со стороны вендора. Считать эти цифры эквивалентными — значит в тридцать раз завышать обязательства Broadcom.

Самые интересные имена в списке

Две из пяти подтвержденных моделей — китайские. В релизе Qwen 3.7-Max описывается как проприетарная мультимодальная модель с контекстным окном в один миллион токенов, доступная для sovereign, on-premises доступа; GLM 5.2 — это open-source универсальная языковая модель Z.ai, ориентированная на локальные инструменты для кодирования и рассуждений. Для компании, которая не может отправлять данные в публичное облако, это поддерживаемый путь к китайским open-weight-моделям на принадлежащем ей оборудовании — с американским стеком в придачу. Оптимизированная для Японии cotomi от NEC находится в том же списке по той же причине: суверенность, а не лидерство в бенчмарках.

Две цифры, которые не являются измерениями

В релизе MLPerf Inference v5.1 упоминается как программа измерений. Это ссылка на методологию, а не опубликованный результат MLPerf — никаких показателей производительности в объявлении нет. А часто цитируемые 56% предприятий, использующих production inference в частном облаке, взяты из собственного опроса Broadcom Private Cloud Outlook 2026, а не от независимой аналитической компании.

Что говорит сама упаковка

Подтверждение фиксированного короткого списка на указанном оборудовании — так инфраструктурные вендоры всегда продавали базы данных и гипервизоры: выбираете поддерживаемые сочетания, берете на себя контракт на поддержку. Применение этого подхода к обслуживанию моделей сужает выбор для предприятия с "любой модели на Hugging Face" до "тех пяти, по которым мы ответим на звонок".