2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

NVIDIA为Agent AI基础设施打造的Vera CPU正在主要云提供商和AI实验室大规模交付

英伟达官方——路线图/产品的第一手确认。
官方披露Slicast · 2026年9月11日 · 美国 · 来源: NVIDIA Blog

AWS收到了其首个NVIDIA Vera CPU服务器和Vera Rubin GPU,由NVIDIA超大规模及HPC副总裁Ian Buck在西雅图亲手交付。AWS是Vera在整个AI生态系统中快速部署的最新站点。此前,Buck将Vera CPU系统交付给了Oracle云基础设施和三家领先的AI实验室:Anthropic、OpenAI和SpaceXAI。

Ian Buck解释了这一时刻的重要意义。"代理型AI正在AI工厂中创造新的CPU时刻——当模型从回答问题转变为主动采取行动时,Vera被专门设计用于在规模化下保持这项工作的运行。"这个潜在的转变反映了代理型AI如何给基础设施带来新的需求。随着模型越来越多地执行超越简单问答的复杂任务,每个代理型沙箱、工具调用、编排层和长上下文检索操作都代表了GPU无法单独处理的CPU工作。

Vera针对这一现实进行了专门设计。该处理器集成了88个定制NVIDIA设计的Olympus核心,提供1.2TB/s的内存带宽,在代理型AI工作负载上相比传统设计提供高达1.8倍的单核性能提升。这一架构允许工作在恒定负载下更快地完成,提高整个AI工厂的效率,帮助用户更快地获得结果。

在Oracle云基础设施公司,交付仪式在Oracle AI客户卓越中心举行,主要负责产品管理的Karan Batta和首席客户与合作伙伴成功官Gary Miller参观了开箱的Vera CPU系统。OCI计划从2026年开始部署数十万个NVIDIA Vera CPU。Batta阐述了其中的原因:"Vera的架构是为高吞吐量推理工作负载专门打造的,提供OCI驱动下一代企业AI所需的效率、密度和占用空间。"OCI是第一个以超大规模部署Vera的云服务提供商。

在SpaceXAI位于帕洛阿尔托的办公室,NVIDIA团队为Elon Musk详细介绍了该系统,Musk就核心、内存布局和散热提出了详细问题。SpaceXAI正在评估Vera用于强化学习工作负载和驱动其训练栈的基于代理型的模拟管道。在OpenAI的Mission Bay总部,计算基础设施负责人Sachin Katti在露天阳台上接收了交付物,Buck讲解了Vera的功能并打开系统展示其内部。在Anthropic位于旧金山的办公室,计算负责人James Bradbury了解了新CPU如何区别该系统。Bradbury表示:"扩展计算是模型增长的重要加速因素。我们很高兴看到Vera在解决代理型工作负载时作为生态系统中颇有前景的一部分而出现。"

Vera作为NVIDIA更广泛共同设计理念的一部分运行,与Rubin GPU、BlueField-4 DPU、Spectrum-X和MGX机架架构协同工作。Vera还充当Vera Rubin NVL72的主处理器,通过第二代NVIDIA NVLink-C2C与一对Rubin GPU配对。在这些系统中,Vera和Rubin共享统一的内存架构,使加速计算保持高利用率,Vera的快速CPU核心和互连在编排、控制和数据移动上的能效是传统基础设施的2倍。

阅读原文