AMD ha lanzado Helios, su primer sistema de IA a escala de rack y su intento más directo hasta la fecha de competir con los racks Grace Blackwell y Vera Rubin de Nvidia, y lo ha hecho con un cliente destacado. Microsoft dijo que desplegará Helios en Azure, posicionando a AMD como una auténtica segunda fuente para el cómputo que impulsa la inferencia de grandes modelos.

Lo que incluye un rack Helios

Un solo rack Helios combina 72 GPU Instinct MI455X con 18 CPU EPYC "Venice" (más de 4.600 núcleos), 31 TB de HBM4, 1,4 PB/s de ancho de banda agregado de memoria y 2,9 exaflops FP4 de cómputo de inferencia, todo ello conectado con la red Pensando de AMD y su pila de software abierta ROCm. Los envíos comenzarán en la segunda mitad de 2026.

Microsoft aporta la demanda

Microsoft utilizará Helios para la inferencia de modelos de frontera y está añadiendo dos familias de VM de Azure basadas en EPYC "Venice" — HDv2 para cargas de trabajo intensivas en datos y agentivas, y HXv2 para diseño de semiconductores — además de una instancia ND MI455X v7. Satya Nadella dijo que Microsoft está "ampliando la cartera de infraestructura de Azure con AMD Helios para ofrecer a los clientes el rendimiento, la escala y la elección que necesitan". AMD se suma a Meta, OpenAI, Oracle y Tata Consultancy Services en la lista de compradores.

La propuesta económica de AMD

Los analistas de Futurum sitúan Helios en torno a 5 millones a 5,5 millones de dólares por rack, por encima de los 3,5 millones a 4 millones estimados para Vera Rubin de Nvidia, pero AMD está defendiendo el coste total de propiedad y no el precio de catálogo. Forrest Norrod, responsable de centros de datos, dijo que la empresa está "muy centrada en ofrecer el mejor coste total de propiedad, el menor coste por token". AMD dijo a CNBC que espera ingresar decenas de miles de millones en ingresos por IA para centros de datos a partir de 2027.

Sigue siendo la rezagada

La brecha sigue siendo enorme: Nvidia controla más del 95% del mercado de GPU para centros de datos, frente a aproximadamente el 4,5% de AMD. Pero un compromiso nominal de Azure, que llega dos días antes de la conferencia Advancing AI de AMD el 22 de julio, ofrece a la competidora algo que le faltaba: un hyperscaler dispuesto a poner en marcha su sistema a escala de rack a gran escala.