Broadcom aprovechó VMware Explore en Las Vegas para anunciar un conjunto de modelos validados para VMware Cloud Foundation, de modo que las empresas puedan ofrecer model-as-a-service sobre su propio hardware. Se nombran cinco: Nemotron 3 de Nvidia, Gemma 4 de Google DeepMind, cotomi de NEC, Qwen 3.7-Max de Alibaba Cloud y GLM 5.2 de Z.ai.
Cinco y 150 no son la misma afirmación
El comunicado menciona ambas cifras en párrafos contiguos, pero significan cosas distintas. Cinco modelos han sido probados y validados por Broadcom en configuraciones específicas. Más de 150 es el recuento de modelos de código abierto que el tiempo de ejecución vLLM puede servir técnicamente, una afirmación sobre capacidades sin garantía del proveedor asociada. Tratar ambas cifras como equivalentes multiplica por treinta el compromiso de Broadcom.
Los nombres interesantes de la lista
Dos de los cinco modelos validados son chinos. Qwen 3.7-Max se describe en el comunicado como un modelo multimodal propietario con una ventana de contexto de un millón de tokens, ofrecido para acceso soberano, en las instalaciones; GLM 5.2 es el modelo general de lenguaje de código abierto de Z.ai, orientado a agentes locales de programación y razonamiento. Para una empresa que no puede enviar datos a una nube pública, esta es una vía compatible para modelos chinos de pesos abiertos sobre hardware de su propiedad, con la pila de un proveedor estadounidense alrededor. cotomi, de NEC, optimizado para japonés, aparece en la misma lista por la misma razón: soberanía, no liderazgo en benchmarks.
Dos cifras que no son mediciones
El comunicado cita MLPerf Inference v5.1 como programa de medición. Eso es una referencia a una metodología, no a un resultado publicado de MLPerf: en el anuncio no aparecen cifras de rendimiento. Y el frecuentemente citado 56% de empresas que ejecutan inferencia en producción en nube privada procede de la propia encuesta de Broadcom Private Cloud Outlook 2026, no de una consultora independiente.
Lo que dice el empaquetado
Validar una lista corta y fija sobre hardware concreto es así como los proveedores de infraestructura han vendido siempre bases de datos e hipervisores: se eligen las combinaciones compatibles y se asume el contrato de soporte. Aplicarlo al servicio de modelos hace que la elección de la empresa pase de "cualquier modelo en Hugging Face" a "los cinco sobre los que nos haremos cargo por teléfono".
