NVIDIA Vera Rubin 实现更高每瓦性能与最低 Token 成本,全球合作伙伴部署加速
摘要
NVIDIA 正式发布 Vera Rubin 平台,强调其从芯片到电网的协同设计,实现业界领先的每瓦性能和最低 Token 成本,并宣布已在全球 30 余国与 CoreWeave、微软等伙伴部署。
核心要点
- Vera Rubin NVL72 正在 CoreWeave、Google Cloud、微软 Azure、Oracle Cloud 和 Nebius 等伙伴处加速生产,覆盖 30 国家 350 多家工厂。
- CoreWeave 在 DeepSeek-R1 基准测试中测得,Vera Rubin 每兆瓦吞吐量是 Grace Blackwell NVL72 的 10 倍。
- 平台基于 7 枚芯片与 5 个机架托盘极端协同设计,包括 Vera Rubin NVL72、Vera CPU、Groq 3 LPX、Spectrum-6 SPX 和 BlueField-4 STX。
- Vera CPU 采用定制 Olympus 核心,单线程性能提升 2 倍,核间带宽提升 3 倍,内存延迟降低 40%,专为智能体工作负载优化。
- NVLink 6 复杂工作负载吞吐量超 2 倍,延迟降低 3 倍;Spectrum-X Ethernet 提供 1.6 倍 RDMA 带宽;共封装光学功耗降 5 倍,MTBI 提升 10 倍。
原文佐证
- 10x more throughput per megawatt than Grace Blackwell NVL72
- delivers 2x single-threaded performance, 3x core-to-core bandwidth and 40% lower memory latency versus competing chiplet designs
- cutting compute tray assembly time from hours to one minute
AI 洞察
Vera Rubin 的发布标志着 NVIDIA 从芯片级优化转向系统级协同设计的新阶段,直接瞄准 AI 工厂的核心瓶颈——能效与总拥有成本,这可能重塑 AI 基础设施的经济性,迫使行业从关注 GPU 数量转向每瓦性能与 Token 成本。与微软、Mistral 在欧洲的合作突显了 NVIDIA 推动开放模型与主权 AI 的战略,有望加速区域化 AI 部署,并对全球 AI 政策与竞争格局产生深远影响。