AMD lanzó Helios, su primer sistema de IA a escala de rack, en Advancing AI 2026 en San Francisco el jueves. Lisa Su afirmó que el rack ya está en producción, con envíos a socios a partir de finales del tercer trimestre y un aumento de ritmo durante el cuarto trimestre y hasta la primera mitad de 2027.

Qué incluye

Setenta y dos aceleradores Instinct MI455X y dieciocho CPU EPYC "Venice" de sexta generación en 18 bandejas de cómputo. La memoria total es de 31TB de HBM4 con 1.7 PB/s de ancho de banda agregado, para 2.9 exaflops de pico MXFP4 y alrededor de 1.4 exaflops en FP8. La escala ascendente alcanza 260 TB/s sobre UALink-over-Ethernet a través de doce switches Broadcom Tomahawk 6; la escala horizontal añade 43 TB/s. Se trata de una unidad doble ancha OCP Open Rack Wide con un peso de aproximadamente 7,000 libras y un consumo de 225-245 kilovatios bajo carga en un bus de CC refrigerado por líquido de 50 voltios.

Los componentes

Cada MI455X incorpora 432GB de HBM4 en doce stacks a 23.3 TB/s, con 320.000 millones de transistores en doce chiplets —ocho die de cómputo en TSMC N2 y cuatro en N3. AMD la sitúa hasta 4x por encima de la MI355X en MXFP4. Venice alcanza un máximo de 256 núcleos y 512 hilos en el proceso de 2nm de TSMC, lo que lo convierte en el primer CPU x86 para servidores en producción en volumen en ese nodo, con aproximadamente un 70% más de capacidad de cómputo que Turin. La conectividad corre a cargo de Pensando: tres NIC Vulcano de 800G por GPU y un DPU Salina de 400 por placa.

La comparación con Nvidia

Frente a Vera Rubin NVL72, la propia modelización de AMD afirma 15% más capacidad de cómputo para IA, 50% más capacidad HBM, un 50% más de ancho de banda de escala horizontal por GPU y hasta 30% más tokens de inferencia por dólar —alcanzando el mismo ancho de banda de escala ascendente de 3.6 TB/s por GPU con un tercio de los ASIC de conmutación. Los analistas de Futurum estiman un rack Helios en $5-5.5 million frente a $3.5-4 million para Rubin; AMD no publicó precio.

La brecha

AMD controla aproximadamente un 4.5% del mercado de GPU para centros de datos frente al 95% y más de Nvidia. Entre los clientes citados figuran OpenAI, Anthropic, Meta, Microsoft, Oracle, HUMAIN, TensorWave, Vultr y Cirrascale. Ashish Nadkarni, de IDC, dijo que AMD está "avanzando de forma constante para ser el sólido número 2". Helios 500, con MI500 y EPYC "Verano", está previsto para 2027.