NVIDIA新Rubin平台将内存架构视为与计算能力同等重要的设计约束。
在拉斯维加斯举行的2026年国际消费类电子产品展览会(CES)上,英伟达公司着手解决业界最紧迫的难题:人工智能计算需求激增以及随之而来的存储器供应短缺。该公司正式推出了Rubin平台,由六颗芯片组成,可整合为一个AI超级计算机。英伟达声称该平台比其Blackwell型号更高效,在计算能力和内存带宽方面均有所提升。英伟达首席执行官詹森·黄(Jensen Huang)在一份新闻稿中表示:"Rubin的推出恰逢其时,因为人工智能计算在训练和推理方面的需求都在急速增长。"
基于Rubin的产品将从英伟达合作伙伴于2026年下半年推出,预期被AWS、Anthropic、Google、Meta、Microsoft、OpenAI、Oracle和xAI所采用。Anthropic首席执行官达里奥·阿莫代(Dario Amodei)对该公告表示赞赏,称"英伟达Rubin平台在效率方面的提升代表了一种基础设施进步,可以实现更长的内存、更好的推理能力和更可靠的输出。"根据公司高管的说法,Rubin将推理令牌成本降低最多十倍,并将用于训练依赖专家混合(MoE)架构(如DeepSeek)的模型所需的GPU数量减少四倍。
推动这些产品公告的严重存储器短缺已达到临界水平。据科技媒体Tom's Hardware最近的报告,巨型数据中心项目需要全球DRAM芯片产量的大约40%。这种稀缺导致消费电子产品价格上涨,也有传言称GPU价格将随之上升。根据韩国新闻社Newsis的报告,芯片制造商AMD预计将在本月晚些时候提高其某些GPU产品的价格,而英伟达据称将在2月份效仿。英伟达一直在积极应对这一瓶颈,上个月进行了有史以来最大规模的收购,收购了专门从事推理业务的芯片制造商Groq。
除了Rubin,英伟达还通过推出一种新型AI原生存储基础设施(称为推理上下文内存存储平台)来应对代理型AI不断变化的基础设施需求。代理型AI系统在过去一年已成为业界的中心,由于需要记住早期交互中的信息以自主执行复杂任务,因此需要更大的内存容量。英伟达高性能计算和AI超大规模基础设施解决方案高级总监迪恩·哈里斯(Dion Harris)解释了核心挑战:"瓶颈正在从计算转向上下文管理。为了实现扩展,存储不能再被当作事后补救。"他进一步指出:"随着推理扩展到千亿级规模,上下文成为一类一等公民级别的数据类型,新的英伟达推理上下文内存存储平台在支持这一需求方面处于理想的位置。"
虽然这些创新可能有助于缓解困扰业界增长的芯片短缺和内存瓶颈,但其他挑战仍然存在。即使内存问题得到解决,人工智能行业在其前所未有的增长中仍将面临其他瓶颈,最值得注意的是数据中心对美国电网造成的巨大压力。