芯片与硬件 · 报道
OpenAI发布Jalapeño,这是其与Broadcom合作设计的首款定制AI推理芯片,目标将LLM推理成本降低50%。开发耗时九个月,计划于2026年底在千瓦级数据中心部署。
OpenAI的定制芯片垂直整合推理基础设施,挑战英伟达主导地位,加速从GPU中心向专用推理架构的转变。
行业媒体Slicast · 2026年6月24日 UTC 15:50 · 美国 · 来源: Wccftech
重要度 90OpenAI宣布推出其首款定制芯片Jalapeño,该芯片专为AI推理工作负载设计,由博通(Broadcom)制造。OpenAI首席执行官萨姆·奥特曼(Sam Altman)和博通首席执行官何庆生(Hock Tan)展示了该芯片的首批晶圆。这一公告反映了AI公司为智能体AI时代开发定制芯片的更广泛趋势——Anthropic正在探索定制硅而Google正在推进其既有的TPU战略。
OpenAI将Jalapeño描述为其LLM推理未来愿景的开始。该芯片代表了公司正在构建的多代计算平台中的首个AI加速器,旨在使AI更快速、更可靠、更易获得。Jalapeño仅用九个月时间从零开始设计——从初步设计到制造流片——它完全专注于AI工作负载,而不是作为从早期架构改编的通用加速器。
该平台得到了包括博通和Celestica在内的强大生态系统的支持,这些公司将支持芯片实现、板卡和机架系统集成、高性能网络和可扩展的生产系统。Jalapeño是为驱动ChatGPT、Codex、API和未来智能体产品的LLM工作负载量身定制的,同时灵活到足以与行业内所有LLM兼容。
该芯片结合了当今领先AI加速器的功率和吞吐量,以及接近最快专用推理系统的延迟,使其非常适合大规模交互式LLM产品。早期工程样品已在生产目标频率和功耗下运行包括GPT-5.3-Codex-Spark在内的ML工作负载。该芯片具有八个HBM位点和中心可见的计算核心。
首批Jalapeño平台计划于2026年底前部署,后续年份计划进行扩展。这一多代计划反映了OpenAI多样化其计算组合的战略。虽然该公司维持与NVIDIA的合作涉及10GW的系统,但定制硅投资减少了对单一芯片制造商的依赖,并在行业供应约束持续存在的情况下提供了灵活性。