Broadcom a profité de VMware Explore à Las Vegas pour annoncer une série de modèles validés pour VMware Cloud Foundation, afin que les entreprises puissent proposer un service de modèle en tant que service sur leur propre matériel. Cinq modèles sont nommés : Nemotron 3 de Nvidia, Gemma 4 de Google DeepMind, cotomi de NEC, Qwen 3.7-Max d'Alibaba Cloud et GLM 5.2 de Z.ai.

Cinq et 150 ne signifient pas la même chose

Le communiqué mentionne les deux chiffres dans des paragraphes adjacents, mais ils ne renvoient pas à la même chose. Cinq modèles ont été testés et validés par Broadcom sur des configurations précises. Plus de 150 correspond au nombre de modèles open source que l'environnement d'exécution vLLM peut techniquement servir — une indication de capacité, sans garantie du fournisseur. Assimiler les deux revient à gonfler de trente fois l'engagement de Broadcom.

Les noms les plus intéressants de la liste

Deux des cinq modèles validés sont chinois. Qwen 3.7-Max est décrit dans le communiqué comme un modèle multimodal propriétaire doté d'une fenêtre de contexte d'un million de tokens, proposé pour un accès souverain, sur site ; GLM 5.2 est le modèle de langage général open source de Z.ai, présenté pour des agents locaux de codage et de raisonnement. Pour une entreprise qui ne peut pas envoyer ses données vers un cloud public, il s'agit d'une voie prise en charge vers des modèles chinois à poids ouverts sur un matériel qu'elle possède — avec, autour, la pile d'un fournisseur américain. cotomi, de NEC, optimisé pour le japonais, figure dans la même liste pour la même raison : la souveraineté, pas la supériorité dans les benchmarks.

Deux chiffres qui ne sont pas des mesures

Le communiqué cite MLPerf Inference v5.1 comme programme de mesure. Il s'agit d'une référence à une méthodologie, pas d'un résultat MLPerf publié — aucun chiffre de performance n'apparaît nulle part dans l'annonce. Et le chiffre souvent cité de 56% des entreprises exécutant l'inférence en production dans un cloud privé provient de l'enquête Private Cloud Outlook 2026 de Broadcom, et non d'un cabinet d'analyse indépendant.

Ce que dit l'emballage

Valider une courte liste fixe sur du matériel nommé est la manière dont les fournisseurs d'infrastructure ont toujours vendu des bases de données et des hyperviseurs : on choisit les combinaisons prises en charge, et on détient le contrat de support. Appliqué à l'exécution de modèles, cela ramène le choix de l'entreprise de « n'importe quel modèle sur Hugging Face » à « les cinq sur lesquels nous décrocherons le téléphone ».