芯片与硬件 · 报道
英伟达已实现其低延迟AI推理LPX机架系统的全速量产。LPX产能的提升将加速优化型推理集群的部署,缩短生成式AI应用的市场投放周期,并提高现有GPU机队的利用率。
LPX机架量产将直接降低推理集群的部署门槛与功耗成本,促使更多企业从训练导向转向高频推理业务,进而拉动配套电源与冷却设备的替换需求。
行业媒体Slicast · 2026年8月27日 · 美国 · 来源: SDxCentral
重要度 79英伟达(Nvidia)已确认其用于AI推理加速器的LPX机架已进入全面生产阶段。该平台于3月在GTC大会上亮相,是在英伟达收购并聘用Groq团队后开发的。这款液冷LPX系统内置256个Groq 3语言处理单元(LPU),并通过640 Tb/s的扩展带宽实现互联。在每个机架内部,BlueField-4数据处理单元(DPU)、Vera中央处理器(CPU)机架以及STX存储服务器通过近期推出的Spectrum-6以太网网络技术进行集成。
LPX并非旨在取代英伟达的旗舰级NVL72平台,而是作为补充解决方案,专为需要低延迟AI推理能力的运营商量身定制。在本周于帕洛阿尔托举行的Hot Chips会议上,英伟达展示了行业基准测试结果,表明LPX平台每秒可维持生成3,400个输出令牌(tokens)。该公司表示,该架构可将智能体工作流的执行时间从数小时缩短至数分钟,使AI代理及其他对延迟敏感的应用程序的响应速度提升四倍。
英伟达创始人兼首席执行官黄仁勋表示:“LPX将改变智能的生产方式,在AI吞吐量、效率和响应速度方面带来又一次巨大飞跃。推理是AI的增长引擎。英伟达Grace Blackwell和NVL72以前所未有的性能和效率飞跃,彻底改变了大语言模型(LLM)的推理能力。Vera Rubin延续了这一愿景,推出了针对智能体AI时代设计的、经工作负载优化的AI工厂配置,并通过LPX推动超快令牌生成的性能前沿。”
LPX平台计划于今年晚些时候上市。早期采用者之一是Nebius,该公司计划将其Token Factory服务整合进Groq 3 LPX架构中。Nebius首席技术官Danila Shtan表示,此次部署将使“智能体循环中的每一步都感觉瞬间完成”。