Broadcom ha usato VMware Explore a Las Vegas per annunciare una serie di modelli convalidati per VMware Cloud Foundation, così che le imprese possano offrire un modello come servizio sul proprio hardware. I modelli nominati sono cinque: Nemotron 3 di Nvidia, Gemma 4 di Google DeepMind, cotomi di NEC, Qwen 3.7-Max di Alibaba Cloud e GLM 5.2 di Z.ai.

Cinque e 150 non sono la stessa cosa

Il comunicato riporta entrambe le cifre in paragrafi adiacenti, ma indicano cose diverse. Cinque modelli sono stati testati e convalidati da Broadcom su configurazioni specifiche. Più di 150 è il conteggio dei modelli open source che il runtime vLLM può tecnicamente servire — una dichiarazione di capacità, senza alcuna garanzia del fornitore. Trattare le due cifre come equivalenti gonfia di trenta volte l'impegno di Broadcom.

I nomi più interessanti nell'elenco

Due dei cinque modelli convalidati sono cinesi. Nel comunicato Qwen 3.7-Max è descritto come un modello multimodale proprietario con una finestra di contesto da un milione di token, offerto per un accesso sovereign, on-premises; GLM 5.2 è il modello linguistico generale open source di Z.ai, pensato per agenti locali di coding e reasoning. Per un'impresa che non può inviare dati a un cloud pubblico, si tratta di un percorso supportato verso modelli cinesi a pesi aperti su hardware di sua proprietà — con attorno lo stack di un fornitore statunitense. cotomi, il modello giapponese ottimizzato di NEC, compare nella stessa lista per lo stesso motivo: sovranità, non leadership nei benchmark.

Due numeri che non sono misurazioni

Il comunicato cita MLPerf Inference v5.1 come programma di misurazione. Si tratta di un riferimento a una metodologia, non di un risultato MLPerf pubblicato — nell'annuncio non compare alcun dato di performance. E il 56% spesso citato delle imprese che eseguono inferenza in produzione nel private cloud proviene dal sondaggio proprietario di Broadcom Private Cloud Outlook 2026, non da una società di analisi indipendente.

Cosa dice il packaging

Convalidare un elenco ristretto e fisso su hardware nominato è il modo in cui i fornitori di infrastrutture hanno sempre venduto database e hypervisor: si scelgono le combinazioni supportate, si sottoscrive il contratto di assistenza. Applicarlo al model serving significa restringere la scelta dell'impresa da "qualsiasi modello su Hugging Face" a "i cinque di cui risponderemo al telefono".