2026年9月15日星期二
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

英伟达推出Blackwell Ultra变体,针对智能体AI工作负载优化。

Blackwell产品扩展在推理成本效率压力下保持竞争力。
行业媒体Slicast · 2025年3月19日 UTC 12:00 · 全球 · 来源: siliconangle.com
重要度 76

工智能代理主导了英伟达公司(Nvidia Corp.)举办的GTC 2025大会的议题,该公司揭露了Nvidia Blackwell Ultra——其最新的GPU平台演进,旨在支持下一代AI推理工作负载。公司同时推出了首款由Blackwell驱动的AI开发者台式电脑。Blackwell Ultra对一年前宣布的原始Blackwell架构进行了重大升级,改进了AI训练和推理工作负载的性能和规模,并使所谓的AI代理能够自主运行,执行多种任务,用户只需提供一个描述期望结果的简单提示词即可。

Blackwell Ultra整合了英伟达GB300 NVL72机架级解决方案,该方案包含72个最新的Blackwell GPU和36个基于Arm Neoverse的英伟达Grace中央处理器,它们协同运行,仿佛是一个超高性能芯片。结合英伟达HGX B300 NVL16基板系统,这一配置相比去年的GB200 NVL72机架级方案提供了1.5倍更好的AI性能,与采用旧款Hopper架构GPU的系统相比,可将所谓AI工厂的"收入机会"提升高达50倍。英伟达首席执行官黄仁勋为追求更强计算能力的举措做出了解释,他表示:"推理和代理型AI需要数个数量级更多的计算性能。我们为这一时刻设计了Blackwell Ultra。它是一个单一多功能平台,可以轻松高效地执行预训练、后训练和推理推断。"

Blackwell Ultra架构集成了英伟达的Spectrum-X以太网和Quantum-X800 InfiniBand网络系统,为系统中的72个GPU各提供高达800千兆字节/秒的数据吞吐量,同时配备英伟达BlueField-3数据处理单元集群来处理非关键计算任务,使GPU能够专注于训练和推理。GB300 NVL72系统将通过英伟达DGX Cloud平台提供,这是一项托管AI基础设施服务,运行在包括Amazon Web Services和Google Cloud在内的主要云服务商上,同时也可通过英伟达DGX SuperPOD硬件系统进行本地部署。英伟达向包括思科系统公司(Cisco Systems Inc.)、戴尔科技公司(Dell Technologies Inc.)、惠普企业公司(Hewlett Packard Enterprise Co.)、联想集团有限公司(Lenovo Group Ltd.)和美超微计算机公司(Supermicro Computer Inc.)在内的主要服务器合作伙伴提供Blackwell Ultra架构,华硕电脑公司(AsusTek Computer Inc.)、技嘉科技有限公司(Gigabyte Technology Co., Ltd.)、佩卓龙公司(Pegatron Corp.)和英特科公司(Inventec Corp.)等其他厂商计划在今年晚些时候销售基于Blackwell Ultra的服务器。该平台也将在Amazon Web Services、Google Cloud、Microsoft Azure、Oracle Cloud Infrastructure以及GPU云服务商CoreWeave和Crusoe上提供。

英伟达还推出了首款由Blackwell GPU驱动的"个人AI超级计算机",以支持在多个位置进行代理型AI开发。这些系统有两种形式——DGX Spark和DGX Station——作为英伟达Project DIGITS项目的一部分开发,面向AI开发者、研究人员和数据科学家在本地进行大语言模型的原型设计、微调和实验。这些由华硕、戴尔、惠普和联想等公司制造的系统配备单个英伟达GB10 Grace Blackwell超级芯片,结合第五代张量核心和FP4支持,使其能够处理每秒1万亿次AI计算操作。这使AI开发者、研究人员和学生能够在本地获得与通常仅在数据中心中才能找到的计算能力相当的AI计算能力。

阅读原文
英伟达推出Blackwell Ultra变体,针对智能体AI工作负载优化。 · Slicast