AMD a lancé Helios, son premier système d’IA à l’échelle d’un rack et sa tentative la plus directe à ce jour pour rivaliser avec les racks Grace Blackwell et Vera Rubin de Nvidia — avec, en prime, un client vedette. Microsoft a déclaré qu’il déploierait Helios sur Azure, positionnant AMD comme une véritable seconde source pour la puissance de calcul qui alimente l’inférence des grands modèles.
Ce qu’embarque un rack Helios
Un rack Helios associe 72 GPU Instinct MI455X à 18 CPU EPYC "Venice" (plus de 4 600 cœurs), 31 To de HBM4, 1,4 Po/s de bande passante mémoire agrégée et 2,9 exaflops FP4 de calcul d’inférence, le tout relié par le réseau Pensando d’AMD et sa pile logicielle ouverte ROCm. Les livraisons débuteront au second semestre 2026.
Microsoft apporte la demande
Microsoft utilisera Helios pour l’inférence de modèles de pointe et ajoute deux séries de VM Azure basées sur EPYC "Venice" — HDv2 pour les charges de travail gourmandes en données et agentiques, et HXv2 pour la conception de semi-conducteurs — ainsi qu’une instance ND MI455X v7. Satya Nadella a déclaré que Microsoft "élargit le portefeuille d’infrastructure Azure avec AMD Helios afin d’offrir aux clients les performances, l’échelle et le choix dont ils ont besoin". AMD rejoint Meta, OpenAI, Oracle et Tata Consultancy Services sur la liste des acheteurs.
L’équation économique qu’AMD met en avant
Les analystes de Futurum évaluent Helios à environ 5 millions à 5,5 millions de dollars par rack, au-dessus des 3,5 millions à 4 millions de dollars estimés pour Vera Rubin de Nvidia, mais AMD mise sur le coût total de possession plutôt que sur le prix affiché. Forrest Norrod, le responsable des datacenters, a déclaré que l’entreprise se concentre "très fortement sur la fourniture du meilleur coût total de possession, le coût par token le plus bas". AMD a indiqué à CNBC s’attendre à enregistrer des dizaines de milliards de dollars de chiffre d’affaires dans l’IA pour les datacenters à partir de 2027.
Toujours en position d’outsider
L’écart reste immense : Nvidia détient plus de 95 % du marché des GPU pour datacenters, contre environ 4,5 % pour AMD. Mais un engagement nommé d’Azure, intervenant deux jours avant la conférence Advancing AI d’AMD le 22 juillet, donne enfin au challenger ce qui lui manquait : un hyperscaler prêt à déployer son système rack-scale à grande échelle.
