2026年9月27日星期日
AI 基础设施 · 新闻与分析
首页 › 芯片与硬件 › 报道
芯片与硬件 · 报道

英伟达Vera Rubin架构性能较前代提升3.7倍,但价格和供应问题仍未明确。

性能领导力保持,但每瓦成本收益存疑;可能扩大超大规模云商与中小运营商的成本差距。
行业媒体Slicast · 2026年9月26日 UTC 15:08 · 美国 · 来源: Coinpaper
重要度 70

英伟达的Vera Rubin NVL72交付了首个重要的独立基准测试结果,在MLPerf Inference v6.1测试中,其在Qwen3-VL基准上的吞吐量相比英伟达GB300 NVL72提升了3.7倍。在DeepSeek-R1上,性能提升达到了2.5倍。英伟达在其官方MLPerf发布中详细介绍了这些结果,将Vera Rubin的参赛描述为在更广泛部署前的试验性提交。这个区别很重要:3.7倍的数字代表在特定工作负载上测得的最佳性能改进,而不是宣称每个AI应用都会突然快3.7倍。

该基准测试揭示了基础经济学变化的速度有多快。英伟达报告称,四个GB300 NVL72机架包含288个GPU,实现了99%的扩展效率。仅软件改进就在前一个MLPerf轮次基础上产生了1.6倍的性能提升。AMD从另一个方向竞争,提交的产品包括Instinct MI355X和MI350系列加速器,而Crusoe运营的512个GPU系统产生了MLPerf历史上提交的最高聚合代币吞吐量。

其结果是一个异常快速的替换周期。AI云运营商不再只是简单地增加GPU;他们在反复决定现有集群是否仍然能与能够每机架和每兆瓦产生更多代币的更新系统竞争。

这一动态在整个行业造成了融资挑战。CoreWeave最近将可转换票据发行从30亿美元增加到37亿美元,例证了GPU扩张如何迅速转化为资产负债表压力。Nebius也转向了数十亿美元的融资。更广泛的AI基础设施繁荣越来越多地以债务形式融资,债券投资者们正在关注——路透社本周报道称,AI相关借款人正在支付更高的息差,因为投资者质疑该行业将需要多少额外资本。

英伟达主张更高的吞吐量可以降低每个代币的成本,这意味着较新的硬件最终可能通过更好的经济学来证明其投资的合理性。然而,英伟达尚未公开提供一个简单的机架价格,使投资者能够直接比较3.7倍基准收益与收购成本。

阅读原文
英伟达Vera Rubin架构性能较前代提升3.7倍,但价格和供应问题仍未明确。 · Slicast