2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页资本市场报道
资本市场 · 报道

英伟达确认,其与Groq达成的200亿美元战略合作协议下开发的AI推理加速器已正式投入量产。

巨额资本承诺验证了长期定制硅片战略,在市场全面饱和前锁定专用推理产能。
行业媒体Slicast · 2026年8月25日 · 美国 · 来源: qz.com
重要度 90

伟达(Nvidia,股票代码:$NVDA)周一宣布,其Groq 3 LPX推理芯片已投入全面生产,这标志着该公司去年12月以200亿美元收购芯片初创公司Groq资产这一最大规模交易背后技术的关键里程碑。

Groq 3 LPX扩展了英伟达的Vera Rubin平台,专为加速AI推理中的“解码”阶段而设计,该阶段直接决定终端用户的令牌生成速度。据CNBC报道,每个LPX机架容纳256颗独立的Groq 3芯片。该芯片由三星制造,将500兆字节SRAM直接集成到芯片上,从而绕过了通常制约竞争对手推理加速器的内存带宽瓶颈。

在Artificial Analysis进行的基准测试中,Groq 3 LPX在处理开源Gemma 4 31B模型、上下文窗口为100,000个令牌时,实现了每秒3,400个输出令牌的性能。英伟达表示,对于延迟敏感型工作负载,这一性能比最接近的竞争平台快四倍。

AI云提供商Nebius将通过其Nebius Token Factory服务率先部署该芯片。据CNBC报道,这些机架预计将于今年晚些时候上线,同时推出的还有Vera中央处理器和Rubin图形处理器。继Nebius之后,最初独立运营的Groq初创公司计划成为该技术的最早采用者之一。

Nebius首席技术官Danila Shtan表示:“生成是决定AI系统实际响应速度的推理阶段,而这正是NVIDIA Groq 3 LPX旨在加速的部分。”

英伟达高级总监Dion Harris强调了该芯片在使云提供商能够推出高端服务层级方面的商业价值。“对于那些提供令牌服务的机构而言,它解锁了为那些真正要求最高延迟敏感性服务协议的用户和客户提供商用高端服务层级的能力,”Harris指出。他澄清说,Groq 3 LPX的设计目的是补充而非取代英伟达现有的GPU产品组合,后者对于模型训练和通用推理仍然至关重要。“这不是关于取代GPU,”Harris说,“而是关于为工作负载的适当部分使用正确的价格和正确的处理器。”

随着2026年初开始生产,Vera Rubin系统的发货正在加速。英伟达定于周三公布下一季度财报。

阅读原文