Samsung 和 SK Hynix 正在推动一种新型内存进入商业化应用,押注 AI 推理的需求已超出紧挨 GPU 的昂贵高带宽内存。该技术 Compute Express Link (CXL) 在传统 DRAM 与较慢的 SSD 存储之间增加了一个层级——为 AI 系统提供更多可寻址内存的一种方式,而不必完全依赖稀缺且昂贵的 HBM。
CXL 改变了什么
大模型需要将海量参数集和上下文尽可能靠近处理器。HBM 虽然速度快,但容量和供应都有限;系统 DRAM 成本更低,却受限于服务器物理上能装下多少。CXL 允许内存在设备之间通过高速互连进行池化和共享,扩大 GPU 可访问的有效内存——这对大规模提供大模型服务尤为关键。
演示情况
SK Hynix 展示了第二代 256GB CMM-DDR5 模块,运行于 CXL 3.2;其研究人员称,在推理负载上吞吐量最高提升 35.7%。Samsung 测试了一个 1TB CXL memory pool,在八块 GPU 上实现了约 92% 的 DRAM 级推理性能——这一速度接近满速内存,足以用于生产环境,同时增加了更大的容量。
时间表与依赖
Samsung 目标是在 2026 年底量产其 CMM-D 模块,不过由于支持该标准的 Intel 和 AMD 服务器平台推迟,时间也可能滑到 2027 年。Eugene Investment & Securities 分析师 Yim So-jung 表示,CXL “真正会在 2026 年起飞”,而支持 CXL 的主流服务器要到 2028 年才会到来。
内存战争的第二战场
对这两家韩国巨头而言,CXL 是向 AI 系统销售更多内存的一种方式,超越它们已占主导地位的 HBM——同时也瞄准 HBM 本身无法突破的容量上限。它让内存而不仅仅是 GPU,成为决定 AI 模型能以多大规模、以多低成本提供服务的关键杠杆。
