2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

NVIDIA Vera Rubin NVL72平台全面投产,协同设计芯片实现10倍吞吐量提升

英伟达官方——路线图/产品的第一手确认。
官方披露Slicast · 2026年8月11日 · 美国 · 来源: NVIDIA Blog

NVIDIA Vera Rubin正在提高生产速度,机架现已在CoreWeave、Google Cloud、Microsoft Azure、Oracle Cloud Infrastructure和Nebius运行。该平台覆盖30个国家的350多个工厂站点,代表为满足AI计算需求而组装的最大、最成熟的机架级供应链。

Vera Rubin从芯片到电网进行构建,以提供最高的每瓦特性能和最低的token成本。CoreWeave在DeepSeek-R1上进行的首次基准测试演示了该平台的能力:每兆瓦的吞吐量比Grace Blackwell NVL72高10倍,CoreWeave表示这直接针对对电力受限AI工厂最重要的指标。

该平台的强大性能源于七个集成芯片和五个机架托盘之间的极端协同设计:Vera Rubin NVL72、Vera CPU机架、Groq 3 LPX、Spectrum-6 SPX和Vera BlueField-4 STX,全部设计为单一系统,而非由独立的现成产品组装。NVIDIA Vera CPU位于该平台的中心,专为agent时代而设计。其定制Olympus核心相比竞争芯粒设计提供2倍的单线程性能、3倍的核心到核心带宽和40%更低的内存延迟,使其成为agent工作负载中最高效的单线程CPU。

网络性能得到显著改善。该平台第六代NVLink横向扩展在复杂工作负载上提供超过2倍的吞吐量、3倍更低的延迟和比现成以太网高10倍的数据包速率。对于横向扩展网络,Spectrum-X以太网将102.4 Tbps的Spectrum-6交换机系统和1.6 Tbps的ConnectX-9 SuperNICs与自适应路由、高级拥塞控制、遥测和开放操作系统支持相结合,比现成以太网实现1.6倍更高的RDMA带宽。包括CoreWeave、Microsoft、SpaceXAI和Tesla在内的领先基础设施建设者正在部署Spectrum-6交换机以加速他们的AI工厂。NVIDIA的具有共封装光学器件的光子技术用于横向扩展,是业界首次大规模制造,相比可插拔收发器,功耗降低5倍,平均无故障时间提高10倍,CoreWeave、Lambda和Oracle Cloud Infrastructure是首批采用者。

硬件设计创新显著改善了制造和运营。三代机架级协同设计产生了一个Vera Rubin NVL72系统,其托盘中没有电缆、风扇或软管,将计算托盘装配时间从数小时降低到一分钟。该平台采用45摄氏度液冷进口设计,使无冷却机干冷却器运行成为可能。对于新的AI工厂,这种更高温度的干冷却与闭环液冷系统相结合,每兆瓦每年可节省数百万加仑水。

通过扩大的Microsoft和Mistral合作伙伴关系,Vera Rubin正在成为欧洲下一代AI基础设施的基础。一项新的数十亿美元的协议专注于扩展欧洲的AI基础设施,Mistral通过部署数千个最新的NVIDIA Vera Rubin GPU来增加GPU容量,以增加AI计算可用性,并为训练、推理和大规模部署提供共享平台。这解决了欧洲对在其自身法律下运行、近在眼前并完全在其控制范围内的AI基础设施的需求。Agent系统的token消耗量最多可以是传统AI应用的15倍,使高效基础设施成为战略优先事项,不仅需要计算容量,还需要数据控制、治理、弹性和战略自主性。

与NVIDIA的GB200 NVL72相比,Vera Rubin NVL72每兆瓦提供最多10倍的token和每百万token成本降低到十分之一,在相同功耗范围内提供更多智能。Mistral Medium 3.5和OCR 4现已在Microsoft Foundry中推出,Mistral模型已集成到Microsoft Copilot Studio中。通过Azure Local和Foundry Local,客户可以在云和客户控制的环境中使用相同的模型、工具和运营模式。

CoreWeave是第一个启动并验证Vera Rubin NVL72硬件并分享测量性能数据的AI云。在Vera Rubin NVL72上运行DeepSeek-R1基准测试,CoreWeave观察到与Grace Blackwell NVL72相比,每兆瓦每秒token数提高了10倍。DeepSeek-R1的混合专家架构使全对全GPU通信在规模上至关重要,而Vera Rubin NVL72的260 TB/s全对全NVLink 6架构消除了这一约束。CoreWeave部署了NVIDIA Spectrum-X以太网SN6600-LD作为交换结构,基于102.4 Tbps的Spectrum-6交换芯片与液冷设计,每个机架可提供1.64 PB/s,比上一代风冷交换机高100%的容量。

Google Cloud已在其首个A5X实例中为伦敦初创公司Ineffable Intelligence部署了Vera Rubin NVL72,该公司开发通过运行过程中不断学习的下一代智能超学习者系统。

阅读原文