2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

Groq 3 LPX已进入全面量产阶段,专注于Agentic AI应用的高速推理任务。

Groq确定性硅基芯片的商业化爬坡为GPU主导的推理栈提供了替代方案,可能重塑AI集群内的负载分布格局。
行业媒体Slicast · 2026年8月25日 · 美国 · 来源: Technetbook
重要度 79

伟达(NVIDIA)已将其 Groq 3 LPX 推理加速器投入全面生产,该芯片专为满足代理式人工智能(agentic AI)的高强度计算需求而设计。作为 Vera Rubin 平台的扩展产品,这款专用硅片在基准测试中实现了每秒 3,400 个输出令牌(tokens)的性能。Nebius 已成为首家部署该架构的云服务提供商。

代理系统依赖于数千次快速推理步骤,因此原始令牌生成吞吐量对于实时操作至关重要。在 Artificial Analysis 使用开源 Gemma 4 31B 模型进行的基准测试中(上下文窗口为 100,000 个令牌),Groq 3 LPX 确立了新的性能上限。英伟达声称,与最接近的竞争系统相比,该加速器的响应速度快了 4 倍,将漫长的编码任务从数小时缩短至数分钟。

该芯片作为 Vera Rubin NVL72 机架级系统的交互式补充方案发挥作用。虽然传统架构处理通用计算,但 LPX 专门针对生成吞吐量进行了优化,使软件代理能够即时验证代码并执行工具。英伟达首席执行官黄仁勋在 Hot Chips 大会上的演讲中指出,这种工作负载分布的转变具有重要意义:

Nebius 正将该硬件直接集成到其 Token Factory 平台中,允许工程师通过现有的软件接口访问加速性能,而无需重构代码。专业供应商 Groq 也将成为最早将此类单元整合到其服务器舰队中的运营商之一。

更广泛的硬件部署涵盖 5 种专用机架配置中的 7 款不同芯片。这些架构集成了 BlueField 4 数据处理单元、Vera CPU 模块、Vera BlueField 4 STX 存储阵列以及 Spectrum 6 SPX 以太网网络,以在多代理环境中保持低延迟。

阅读原文