AMD ha lanciato Helios, il suo primo sistema AI a livello rack e il suo tentativo più diretto finora di competere con i rack Grace Blackwell e Vera Rubin di Nvidia — e al debutto è arrivato anche un cliente di punta. Microsoft ha dichiarato che distribuirà Helios su Azure, posizionando AMD come una vera seconda fonte per la potenza di calcolo che alimenta l'inferenza dei modelli di grandi dimensioni.

Che cosa contiene un rack Helios

Un singolo rack Helios combina 72 GPU Instinct MI455X con 18 CPU EPYC "Venice" (oltre 4.600 core), 31TB di HBM4, 1,4 PB/s di banda aggregata della memoria e 2,9 exaflop FP4 di potenza di calcolo per l'inferenza, il tutto collegato dal networking Pensando di AMD e dal suo stack software aperto ROCm. Le spedizioni inizieranno nella seconda metà del 2026.

Microsoft porta la domanda

Microsoft utilizzerà Helios per l'inferenza dei modelli di frontiera e sta aggiungendo due serie di VM Azure basate su EPYC "Venice" — HDv2 per carichi di lavoro ad alta intensità di dati e agentici e HXv2 per la progettazione di semiconduttori — oltre a un'istanza ND MI455X v7. Satya Nadella ha affermato che Microsoft sta "ampliando il portafoglio di infrastruttura Azure con AMD Helios per offrire ai clienti le prestazioni, la scala e la scelta di cui hanno bisogno". AMD si unisce a Meta, OpenAI, Oracle e Tata Consultancy Services nell'elenco dei clienti.

L'economia che AMD sta vendendo

Gli analisti di Futurum stimano Helios a circa 5 milioni - 5,5 milioni di dollari per rack, più dei 3,5 milioni - 4 milioni di dollari stimati per Vera Rubin di Nvidia, ma AMD punta sul costo totale di possesso invece che sul prezzo di listino. Il responsabile dei data center Forrest Norrod ha detto che l'azienda è "molto concentrata nel fornire il miglior costo totale di possesso, il costo per token più basso". AMD ha detto a CNBC di aspettarsi di contabilizzare decine di miliardi di dollari di ricavi da AI per data center a partire dal 2027.

Resta comunque un outsider

Il divario resta enorme: Nvidia controlla oltre il 95% del mercato delle GPU per data center, contro circa il 4,5% di AMD. Ma un impegno esplicito di Azure, arrivato due giorni prima della conferenza Advancing AI di AMD del 22 luglio, offre al concorrente qualcosa che finora gli mancava: un hyperscaler disposto a mettere in produzione il suo sistema rack-scale su larga scala.