2026年9月15日星期二
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

Nvidia测试低内存Rubin Ultra配置(192 GB、HBM4),应对HBM供应短缺。

HBM供应约束强制SKU分化;预示推理/MoE工作负载处于关键路径,容忍降低的内存密度。
行业媒体Slicast · 2026年8月12日 UTC 17:33 · 美国 · 来源: Tom's Hardware
重要度 80

报道,英伟达正在测试其即将推出的Rubin Ultra加速器的多个变体,其内存容量低于最初计划,原因是在采购足够HBM方面存在忧虑。据The Information报道,评估中的某些配置仅包括192 GB内存,并使用HBM4而非最初宣布的HBM4E。该报道证实了SemiAnalysis之前关于Rubin Ultra内存降级可能性的评论。

Rubin Ultra在今年早些时候的GTC大会上首次亮相,英伟达展示了一个计算托盘,其中包含四个计算芯片和1 TB的HBM4E内存。该加速器是英伟达Kyber NVL144设计的一部分,计划在2027年推出,尽管SemiAnalysis报道称该机架已延期至2028年。英伟达告诉Tom's Hardware"我们的路线图保持完整",但该公司拒绝澄清延期是否得到确认。

据The Information报道,英伟达正在测试Rubin Ultra版本,其内存为192 GB或256 GB,以及使用少于16个公布的内存堆栈的配置。最值得注意的是,英伟达据称正在测试HBM4而非最初宣布的HBM4E。虽然HBM4E具有传统的代际改进,但它独特地提供了可定制的基础逻辑芯片——这是美光与台积电共同开发的功能,允许客户根据其特定需求定制逻辑芯片。这一复杂性据报道已给供应链带来压力,导致内存制造商无法跟上Rubin Ultra的推出步伐。至少已测试了三种较低内存容量的设计,尽管完整细节仍不清楚。

内存芯片的数量具有重要意义。在6月,有报道称英伟达由于制造复杂性取消了其四芯片Rubin Ultra设计,转而追求双GPU配置。采用双芯片Rubin Ultra,较低的内存容量会更有意义,尽管测试的192 GB和256 GB容量仍低于预期——每个基础Rubin GPU目前配备288 GB的HBM4。

英伟达显然在试图应对一个内存协议多年前就已锁定的局面。该公司持有多项此类协议。在6月,英伟达宣布与SK海力士建立合作伙伴关系,以开发下一代内存技术,包括HBM、LPDDR5X和DDR5。在7月,英伟达扩大了这一关系,做出了5000亿美元的战略承诺,其中包括长期内存供应协议。

内存短缺正在影响当前市场上几乎所有设计,使用HBM的企业系统特别容易受影响。上周,Digitimes报道称三星、SK海力士和美光已售出其2027年之前的HBM产能。SK海力士首席执行官郭万进(Kwak Noh-jung)最近表示,2027年将是内存短缺的"最糟糕一年",供应约束将延续至2030年。

尽管英伟达考虑了较低内存配置,但至少一位英伟达客户告诉The Information,每GPU内存不是他们的主要关注点,他们看重与英伟达的长期关系而非具体硬件规格。在回应该报道时,英伟达声称:"通过NVIDIA Rubin Ultra,我们在计算、网络和内存方面进行优化,为客户的AI部署提供最佳性能和效率。这些优化使我们能够制造更多GPU和部署更多AI系统。"

阅读原文
Nvidia测试低内存Rubin Ultra配置(192 GB、HBM4),应对HBM供应短缺。 · Slicast