2026年9月15日星期二
AI 基础设施 · 新闻与分析
首页头条报道
头条 · 报道

英伟达Rubin Ultra瞄准768GB HBM4E内存,Kyber平台保持进度。

确认下代GPU内存路线图,支持超长文本推理和大模型训练,预示对先进内存容量需求持续强劲。
行业媒体Slicast · 2026年8月13日 UTC 16:45 · 美国 · 来源: Crypto Briefing
重要度 82

伟达Rubin Ultra GPU采用12堆栈HBM4E内存,目标容量达768GB,相比当前Rubin GPU支持的288GB HBM4是重大升级。原始设计计划采用16堆栈HBM4E实现1TB内存,但由于预期HBM4E产能链出现供应瓶颈,该目标已被下调。英伟达同时也在评估采用8堆栈HBM4E配置作为备选方案。

Kyber机架级平台(包括NVL144和NVL576系统)仍在积极推进中,计划于2027年下半年与Rubin Ultra一同发布。此前有报道称Rubin Ultra可能推迟到2028年,这将对英伟达的年度GPU发布周期造成实质性打击。英伟达已公开否认这些说法,并重申了2027年下半年的发布目标。

公司路线图规划在2026年推出Vera Rubin GPU,随后于2027年推出Rubin Ultra。Rubin Ultra采用多芯片设计,旨在提高每个机架的GPU密度,Kyber NVL576单机架配置可扩展到576个GPU。

英伟达从SK海力士、三星和美光采购HBM。SK海力士被广泛认为是当代工艺节点下HBM的领先供应商,其HBM4E产能将成为整个产业在2026年和2027年的瓶颈。三星和美光正在推进各自的HBM4E项目,但在主要客户的认证中面临延迟。英伟达的多供应商策略减少了单一源依赖,但并未完全消除品类风险。

这次内存升级具有重大实际意义。在大型语言模型训练中,GPU的内存带宽和容量决定了单芯片能容纳的模型规模,以及系统在不频繁进行片间数据卸载的情况下的训练效率。从288GB到768GB的升级减少了芯片间数据传输,实现更快的训练速度和更低的能源成本,这远远超出了规格表指标的意义。

阅读原文
英伟达Rubin Ultra瞄准768GB HBM4E内存,Kyber平台保持进度。 · Slicast