2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页数据中心报道
数据中心 · 报道

AWS已承诺在其基础设施中额外部署200万块Nvidia GPU。

这一前所未有的超大规模云厂商容量承诺将严重挤压全球GPU供应链,加速机柜级密度升级,并迫使电力与冷却网络快速扩容。
行业媒体Slicast · 2026年8月28日 · 全球 · 来源: Data Center Dynamics
重要度 95

马逊云科技(AWS)承诺扩大其英伟达GPU集群规模,同意在全球基础设施中额外部署200万个单位。该扩展协议还加深了两家公司在AI工厂、CPU、网络、开放模型、数据处理和机器人技术方面的合作。

AWS将在2027年和2028年推出这些新GPU。作为该计划的一部分,这家云服务提供商将把基于英伟达Vera CPU的基础设施引入其平台,通过定制的高带宽内存扩展英伟达NVLink Fusion,并在安全的AWS基础设施上为美国政府构建拥有10万块GPU的AI工厂。此外,英伟达的Nemotron模型将通过AWS提供,而Amazon Robotics将整合英伟达的物理AI平台,以推进联合机器人项目。

在GTC 2026大会上,AWS最初宣布计划在2026年为其平台上线超过100万个英伟达GPU,但随后的需求超出了这一预测。新增的200万个GPU将涵盖Blackwell Ultra、Rubin和Rubin Ultra架构。AWS还将通过部署用于EC2 G7实例的英伟达RTX Pro 4500 Blackwell Server Edition GPU来扩大其Blackwell容量,与上一代G6实例相比,这些实例可提供4.6倍的AI推理性能和2.1倍的图形性能。

“客户希望自由选择最适合其AI工作负载的工具,并确信所有组件都能无缝协同工作,”AWS首席执行官Matt Garman表示。“这就是为什么我们大力投资英伟达,使AWS成为运行英伟达AI技术的最佳场所,从网络和安全性到部署,优化我们基础设施的性能。这种扩展的合作为前沿实验室、企业和政府提供了更多在AWS上构建和部署AI的方式。”

“英伟达和AWS共同打造了AI时代最伟大的增长引擎之一,且需求远超所有预测,”英伟达创始人兼CEO黄仁勋说。“过去16年来,我们一直在云端规模化英伟达的计算能力。现在,我们正在全栈层面——包括GPU、CPU、网络、开放模型和软件——扩展我们的合作伙伴关系,以前所未有的速度和规模实现代理式AI和物理AI,这是只有AWS和英伟达才能提供的。此次扩张反映了客户对AWS上英伟达平台的需求。”

在扩大集群规模的同时,AWS仍在运营较旧的硬件。CEO Matt Garman此前曾指出,该公司仍在使用服役六年的A100服务器,并表示“从未退役过任何一台A100服务器”。

此次宣布紧随英伟达本周发布的2026年第二季度财报。该公司本季度营收达到962亿美元,环比增长18%,同比增长106%。GAAP和非GAAP毛利率均稳定在75%。

阅读原文