Nvidia7月21日 发布技术深度解析和白皮书,详细介绍了其 Vera CPU 内部的 Olympus 核心微架构——这款处理器是 Vera Rubin 平台的处理器部分——并公布了首组 SPEC CPU 2026 结果。

真正的新内容是什么

此前已经披露的头条规格——88 核、176 线程、164MB 统一 L3 缓存以及 1.2 TB/s 内存带宽——早在 3月的 GTC 上就已公开。7月21日带来的是内部细节:一个由 16 条指令取指和 48 条指令解码队列供给的 10 路解码器、一个每周期可处理两个分支的神经分支预测器、18 条执行管线(8 条整数、6 条向量/浮点、4 条加载、2 条存储),以及每周期 10 条微操作的重命名能力。

缓存与内存故事

每个核心都配备 64KB 的 4 路 L1 指令缓存96KB 的 6 路 L1 数据缓存2MB 的 L2 缓存,此外还有共享的 164MB L3 缓存和一个 3000 项的 L2 TLB。Nvidia 还描述了一种面向指针密集型数据结构的 图形预取器,以及内存重命名和数值预测。该芯片采用单片裸晶设计——这是 Nvidia 所称避免“chiplet 税”的方式——并由 LPDDR5X 供内存,其声称可提供比 DDR5 低 40% 的延迟和每瓦 5 倍的带宽。

基准成绩,请谨慎解读

Nvidia 报告称,双路 Vera 在 925 SPECrate2026_int_base 上对比双路 AMD EPYC 9755898,约高出 3%。但这些数字是来自预生产系统的估算值,使用 GNU 15.2 自行编译,并非官方 SPEC 提交。官方提交的双路 EPYC 系统成绩已超过 1000,Turin Dense 芯片则超过 1200

下一步走向

早期样片已交付给 OpenAI、Anthropic、Oracle CloudSpaceX AI;HPE 的 ProLiant Compute DL394 Gen12 将于 2026 年秋季上市。Nvidia 声称,在 agentic 工作负载上,相比 x86 最多可提升 1.8 倍