AMD lançou o Helios, seu primeiro sistema de IA em escala de rack e sua tentativa mais direta até agora de competir com os racks Grace Blackwell e Vera Rubin da Nvidia — e a estreia veio com um cliente de peso. A Microsoft disse que implantará o Helios em todo o Azure, posicionando a AMD como uma verdadeira segunda fonte para o poder de computação que sustenta a inferência de grandes modelos.

O que um rack Helios traz

Um único rack Helios combina 72 GPUs Instinct MI455X com 18 CPUs EPYC "Venice" (mais de 4.600 núcleos), 31TB de HBM4, 1,4 PB/s de largura de banda agregada de memória e 2,9 exaflops FP4 de computação de inferência, conectados pela rede Pensando da AMD e por sua pilha de software aberta ROCm. As entregas começam no segundo semestre de 2026.

Microsoft traz a demanda

A Microsoft usará o Helios para inferência de modelos de fronteira e também está adicionando duas séries de VMs do Azure baseadas em EPYC "Venice" — HDv2 para cargas intensivas em dados e agentic e HXv2 para projeto de semicondutores — além de uma instância ND MI455X v7. Satya Nadella disse que a Microsoft está "ampliando o portfólio de infraestrutura do Azure com o AMD Helios para dar aos clientes o desempenho, a escala e a escolha de que precisam". A AMD se junta à Meta, à OpenAI, à Oracle e à Tata Consultancy Services na lista de compradores.

A economia que a AMD está vendendo

Analistas da Futurum estimam o Helios em cerca de US$ 5 milhões a US$ 5,5 milhões por rack, acima dos estimados US$ 3,5 milhões a US$ 4 milhões para o Vera Rubin da Nvidia, mas a AMD está apostando no custo total de propriedade, e não no preço de tabela. O chefe de data center, Forrest Norrod, disse que a empresa está "muito focada em oferecer o melhor custo total de propriedade, o menor custo por token". A AMD disse à CNBC que espera registrar dezenas de bilhões em receita de IA para data centers a partir de 2027.

Ainda uma zebra

A distância continua enorme: a Nvidia controla mais de 95% do mercado de GPUs para data centers, contra cerca de 4,5% da AMD. Mas um compromisso nomeado do Azure, que chega dois dias antes da conferência Advancing AI da AMD em 22 de julho, dá à desafiante algo de que ela vinha carecendo — uma hyperscaler disposta a colocar seu sistema em escala de rack em operação em larga escala.