2026年9月15日星期二
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

NVIDIA发布Rubin CPX GPU架构预览,针对推理和长上下文AI工作负载优化。

专业推理GPU信号NVIDIA向部署优化转变,应对自研芯片竞争。
行业媒体Slicast · 2025年9月9日 UTC 12:00 · 全球 · 来源: datacenterknowledge.com
重要度 70

伟达正在重新定位自己,应对AI数据中心市场的重大转变,从传统的训练工作负载优势转向更加多样化的推理领域。本周二,位于加州圣塔克拉拉的GPU制造商英伟达推出了Rubin CPX,这是一种新型GPU,专门设计用于处理大规模上下文处理,使AI系统能够处理百万token的软件编码和生成式视频应用。这些新单元为推理任务承诺能源效率和高性能,每投资1亿美元可产生50亿美元的token收益,并将在英伟达的Vera Rubin NVL 144 CPX平台内运行。

根据市场分析,这一战略转变应对了快速扩大的机遇。根据Markets and Markets的报告,全球AI推理市场在2025年被估计为1060亿美元,预计到2030年将增长到2550亿美元。英伟达新的推理数据中心平台由Blackwell Ultra和即将推出的Vera Rubin GPU提供支持,旨在应对最具挑战性的工作负载,特别是那些利用Mixture of Experts(MoE)大语言模型架构来驱动所谓"AI工厂"的工作负载。

Moor Insights & Strategy公司副总裁兼首席分析师Matt Kimball支持英伟达的推理重点战略,他告诉Data Center Knowledge:"Rubin是一个强大的产品……就像Blackwell相比Hopper是强大的一样。你们在谈论实现更快、更大规模的推理,并扩展那些token窗口。"然而,Kimball指出Rubin CPX的目标不是一般的企业用户,他表示:"这是拿Rubin并创建一个专门的推理产品,真正针对高端市场",超大规模企业和大型企业可能会形成绝大多数客户。

英伟达AI和数据中心GPU市场营销总监Shar Narasimhan强调了Rubin CPX的市场定位,表示"[Rubin CPX]解锁了一个新的高端用例层,如智能编码系统和视频生成",并补充说"它将大幅提高AI工厂的生产力和性能"。

本周二,英伟达还通过GB300 NVL72机架级系统的基准测试结果展示了其Blackwell Ultra架构的能力,该系统的DeepSeek-R1推理能力比其前代产品提高了1.4倍,并在MLPerf Inference v5.1套件中添加的所有新数据中心基准测试上创造了记录,包括Llama 3.1 405B Interactive、Llama 3.1 8B和Whisper的测试。英伟达加速计算产品部门总监Dave Salvatore表示:"我对这些数字非常满意。随着我们继续优化Blackwell Ultra软件堆栈,我们预计这些数字会随着时间的推移而提高。"根据英伟达的说法,这些基准测试结果凸显了Blackwell Ultra提高AI工厂生产力、增加收入并降低所有权成本的潜力。

阅读原文
NVIDIA发布Rubin CPX GPU架构预览,针对推理和长上下文AI工作负载优化。 · Slicast