AMD 已推出 Helios,这是其首个机架级 AI 系统,也是其迄今对抗 Nvidia 的 Grace Blackwell 和 Vera Rubin 机架最直接的尝试——并且一位重磅客户随之而来。Microsoft 表示,将在 Azure 上部署 Helios,这使 AMD 成为支撑大模型推理算力的真正第二供应来源。

一个 Helios 机架包含什么

单个 Helios 机架整合了 72 块 Instinct MI455X GPU18 颗 EPYC “Venice” CPU(超过 4,600 核)、31TB HBM4、1.4 PB/s 的总内存带宽,以及 2.9 FP4 exaflops 的推理算力,并通过 AMD 的 Pensando 网络技术和开放的 ROCm 软件栈连接在一起。发货将于 2026 年下半年开始。

Microsoft 带来需求

Microsoft 将把 Helios 用于前沿模型推理,并新增两条基于 EPYC “Venice”的 Azure 虚拟机系列——用于数据密集型和 agentic 工作负载的 HDv2,以及用于半导体设计的 HXv2——此外还将推出一个 ND MI455X v7 实例。Satya Nadella 表示,Microsoft 正在“借助 AMD Helios 扩展 Azure 基础设施产品组合,以为客户提供所需的性能、规模和选择”。AMD 由此加入 Meta、OpenAI、Oracle 和 Tata Consultancy Services 的买家名单。

AMD 推销的经济性

Futurum 的分析师估算,Helios 每个机架的价格约为 500 万美元至 550 万美元,高于 Nvidia Vera Rubin 预计的 350 万美元至 400 万美元,不过 AMD 强调的是总拥有成本,而非标价。数据中心业务负责人 Forrest Norrod 表示,公司“非常专注于提供最佳总拥有成本、最低每 token 成本”。AMD 告诉 CNBC,预计从 2027 年开始,数据中心 AI 收入将达到数百亿美元。

仍然是追赶者

差距仍然巨大:Nvidia 在数据中心 GPU 市场占比超过 95%,而 AMD 约为 4.5%。但这份来自 Azure、且具名的承诺在 7 月 22 日 AMD Advancing AI 大会前两天到来,让这家挑战者获得了此前缺少的东西——一家愿意大规模部署其机架级系统的超大规模云服务商。