2026年9月15日星期二
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

英伟达在DeepSeek后将Blackwell Ultra定位为收入增长引擎。

供应商定价和定位策略反映基础设施市场对新兴推理成本竞争的应对。
行业媒体Slicast · 2025年3月19日 UTC 12:00 · 全球 · 来源: crn.com
重要度 71

伟达在GTC 2025大会上推出了黑威尔超(Blackwell Ultra),这是其畅销黑威尔GPU架构的继任者,该芯片特别针对DeepSeek R1等AI推理模型而设计。黑威尔超将最大HBM3e高带宽内存增加50%至288GB,并将4位浮点(FP4)推理性能提升幅度相同。包括戴尔科技、思科、惠普企业、联想和超微在内的技术合作伙伴,以及亚马逊网络服务、谷歌云、微软Azure和甲骨文云基础设施等云服务提供商的黑威尔超产品将在2025年下半年推出。

根据英伟达超大规模和高性能计算副总裁伊恩·巴克的说法,黑威尔超是"为推理时代而构建的"。他通过指出该模型"可以以每美元100万个token或更高的速率提供服务,但通常它们会生成10,000个或更多token来得出答案"来回应对DeepSeek R1成本效益的质疑。他表示,"这个新的推理世界需要新的软件、新的硬件来帮助加速和推进AI"。由于运行DeepSeek和其他AI模型的数据中心代表着一个1万亿美元的机遇,英伟达声称黑威尔超单独就能使"数据中心收入机遇"增加50倍。

性能提升幅度巨大。新的GB300 NVL72机架级平台采用基于黑威尔超的GB300超级芯片对最近推出的GB200 NVL72进行了更新,能够在短短10秒内为DeepSeek-R1提供每秒1,000个token的性能,相比之下,相同功耗下基于HGX H100的数据中心在90秒内仅能提供每秒100个token。巴克指出,"从Hopper到Blackwell,token总量和美元每token的组合扩展了50倍,通过提供更高价值的服务,这提供了更优质的体验和市场中不同的价格点"。GB300 NVL72平台由72个黑威尔超GPU和36个Grace CPU组成,可提供1.1艾字浮点(FP4)密集计算,配有20TB高带宽内存、40TB快速内存、130 TBps NVLink带宽和14.4 TBps网络速度。

英伟达以多种配置提供黑威尔超。采用DGX GB300系统的液冷DGX SuperPod由8个GB300 NVL72平台组成,共包含288个Grace CPU、576个黑威尔超GPU和300TB快速内存,能够实现11.4艾字FP4计算。采用DGX B300系统的风冷DGX SuperPod使用HGX B300 NVL16平台,相比基于Hopper的平台,在大型语言模型上的推理速度快11倍,计算量增加7倍,内存容量增加4倍。此外,英伟达推出了新的黑威尔超动力DGX Station桌面计算机,采用GB300 Grace黑威尔超桌面超级芯片,配有784GB统一系统内存,能够实现20拍字浮点性能,还推出了用于笔记本电脑、台式机和服务器的新型基于黑威尔的RTX Pro GPU。

这一宣布的时机是黑威尔已成为英伟达"最快产品发布",在11月至1月期间的初始出货中产生了110亿美元的收入。该公司去年收入翻倍多,达到1,305亿美元,黑威尔超的推出突显了英伟达维持市场主导地位并确保其产品持续需求的战略。GB300 NVL72平台将在英伟达的DGX Cloud AI超级计算平台上提供,可通过包括AWS、微软Azure和谷歌云在内的云服务提供商访问。

阅读原文
英伟达在DeepSeek后将Blackwell Ultra定位为收入增长引擎。 · Slicast