芯片与硬件 · 报道
OpenAI 和 Broadcom 推出了 Jalapeño,一款为吉瓦级 AI 数据中心部署优化的定制推理处理器,用于生产规模的大语言模型推理工作负载。
超大规模云厂商从商用GPU推理转向定制芯片,减少对NVIDIA依赖,加速行业向专用推理加速器转变。
行业媒体Slicast · 2026年6月25日 UTC 07:51 · 美国 · 来源: NDTV Profit
重要度 95OpenAI与Broadcom宣布推出Jalapeño,一款为大规模AI数据中心部署而定制设计的推理处理器。该芯片针对为ChatGPT等服务提供动力的生产推理工作负载。
Jalapeño针对吉瓦级AI数据中心环境进行了优化,特别关注已训练模型为用户请求服务的推理阶段。通过为这一工作负载构建定制芯片——而不是仅依赖通用GPU——OpenAI解决了在生产规模运行推理的关键效率瓶颈。
此举标志着OpenAI基础设施堆栈垂直整合的策略,继Meta和Google等竞争对手之后开发自有芯片。对于更广泛的AI部署而言,定制推理芯片降低了运营成本和延迟,使前沿模型在需求继续增长的情况下能够实现更高效的服务。