A Broadcom usou o VMware Explore, em Las Vegas, para anunciar um conjunto de modelos validados para o VMware Cloud Foundation, de modo que empresas possam oferecer model-as-a-service em seu próprio hardware. São cinco os nomes citados: Nemotron 3, da Nvidia, Gemma 4, do Google DeepMind, cotomi, da NEC, Qwen 3.7-Max, da Alibaba Cloud, e GLM 5.2, da Z.ai.
Cinco e 150 não são a mesma coisa
O comunicado traz ambos os números em parágrafos adjacentes, e eles significam coisas diferentes. Cinco modelos foram testados e validados pela Broadcom em configurações específicas. Mais de 150 é a contagem de modelos de código aberto que o runtime vLLM pode tecnicamente atender — uma afirmação de capacidade, sem garantia do fornecedor. Tratar os dois como equivalentes amplia em 30 vezes o compromisso da Broadcom.
Os nomes mais interessantes da lista
Dois dos cinco modelos validados são chineses. Qwen 3.7-Max é descrito no comunicado como um modelo multimodal proprietário com janela de contexto de um milhão de tokens, oferecido para acesso soberano, on-premises; GLM 5.2 é o modelo de linguagem geral de código aberto da Z.ai, posicionado para agentes locais de codificação e raciocínio. Para uma empresa que não pode enviar dados para a nuvem pública, trata-se de um caminho suportado para modelos chineses de peso aberto em hardware próprio — com a stack de um fornecedor dos EUA ao redor. O cotomi, da NEC, otimizado para o Japão, aparece na mesma lista pelo mesmo motivo: soberania, não liderança em benchmarks.
Dois números que não são medições
O comunicado cita MLPerf Inference v5.1 como um programa de medição. Isso é uma referência a uma metodologia, não a um resultado publicado do MLPerf — não há números de desempenho em nenhum ponto do anúncio. E os frequentemente citados 56% de empresas que executam inferência em produção na nuvem privada vêm da própria pesquisa da Broadcom, Private Cloud Outlook 2026, e não de uma consultoria independente.
O que a embalagem diz
Validar uma lista curta e fixa em hardware nomeado é como os fornecedores de infraestrutura sempre venderam bancos de dados e hipervisores: escolha as combinações suportadas, assuma o contrato de suporte. Aplicar isso ao serving de modelos significa que a escolha da empresa se estreita de "qualquer modelo no Hugging Face" para "os cinco sobre os quais atenderemos o telefone".
