AMD a lancé Helios, son premier système IA à l’échelle du rack, lors d’Advancing AI 2026 à San Francisco, jeudi. Lisa Su a déclaré que le rack est désormais en production, avec des livraisons aux partenaires à partir de la fin du T3 et une montée en puissance tout au long du T4 jusqu’au premier semestre 2027.
Ce qu’il contient
Soixante-douze accélérateurs Instinct MI455X et dix-huit CPU EPYC "Venice" de sixième génération répartis sur 18 plateaux de calcul. La mémoire totale atteint 31 To de HBM4 avec une bande passante agrégée de 1,7 PB/s, pour 2,9 exaflops en pic MXFP4 et environ 1,4 exaflops en FP8. La montée en charge interne fonctionne à 260 To/s via UALink sur Ethernet à travers douze commutateurs Broadcom Tomahawk 6 ; la montée en charge externe ajoute 43 To/s. Il s’agit d’une unité OCP Open Rack Wide double largeur pesant environ 7 000 livres et consommant 225 à 245 kilowatts en charge sur un bus continu à refroidissement liquide de 50 volts.
Les composants
Chaque MI455X embarque 432 Go de HBM4 répartis sur douze piles à 23,3 To/s, avec 320 milliards de transistors dans douze chiplets — huit dies de calcul en TSMC N2 plus quatre en N3. AMD l’évalue jusqu’à 4x le MI355X en MXFP4. Venice atteint 256 cœurs et 512 threads avec le procédé 2 nm de TSMC, ce qui en fait le premier processeur serveur x86 produit en volume sur ce nœud, avec environ 70 % de calcul en plus que Turin. Le réseau repose sur Pensando : trois NIC Vulcano 800G par GPU, et un DPU Salina 400 par lame.
L’argument face à Nvidia
Face à Vera Rubin NVL72, les propres modélisations d’AMD revendiquent 15 % de calcul IA en plus, 50 % de capacité HBM supplémentaire, 50 % de bande passante de montée en charge en plus par GPU et jusqu’à 30 % de jetons d’inférence par dollar en plus — tout en atteignant la même bande passante de montée en charge de 3,6 To/s par GPU avec trois fois moins de circuits intégrés de commutation. Les analystes de Futurum estiment un rack Helios à 5 à 5,5 millions de dollars, contre 3,5 à 4 millions de dollars pour Rubin ; AMD n’a publié aucun prix.
L’écart
AMD détient environ 4,5 % du marché des GPU pour centres de données, contre plus de 95 % pour Nvidia. Parmi les clients nommés figurent OpenAI, Anthropic, Meta, Microsoft, Oracle, HUMAIN, TensorWave, Vultr et Cirrascale. Ashish Nadkarni, d’IDC, a déclaré qu’AMD « progresse régulièrement pour devenir le solide numéro 2 ». Helios 500, avec MI500 et EPYC "Verano", est prévu pour 2027.
