OpenAI推出Jalapeño,这是其首款定制AI推理芯片,由OpenAI与Broadcom联合开发。该芯片专为LLM推理从头打造,成本降低约50%,性能功耗比超越当前最先进水平,预计于2026年下旬规模化量产。
OpenAI和Broadcom今早发布了他们首款定制AI加速器芯片"Jalapeño",将其定位为专为大型语言模型推理设计的芯片,而非Nvidia或AMD等公司提供的更通用的GPU。根据其创造者的说法,Jalapeño被设计来支撑ChatGPT、Codex、API以及未来的智能体产品的工作负载。Broadcom的新闻稿特别强调它也可能提供给外部AI公司使用——"从零开始为行业内的当前和未来LLM而构建"。
Jalapeño的工程时间表为半导体行业创造了一个惊人的速度,从早期方案到制造就绪仅用时九个月,而新处理器开发周期通常以年计。两家公司将这种速度归功于深度的软硬件协同开发流程,该流程积极使用OpenAI自有模型来加快芯片设计的某些部分。在周三收到早期物理样品后,OpenAI宣布计划从今年年底开始在其活跃数据中心推出这些处理器。OpenAI表示已经在生产工作负载下的芯片上测试了至少一个先前代的模型GPT-5.3-Codex-Spark,尽管目前还在测试环境中。
这一发布标志着ChatGPT创造者在尝试构建完整计算堆栈以使先进AI更快、更可靠和更易获取方面的重大战略扩展。仍有一些未决问题,包括新的Jalapeño芯片与直接竞争对手相比的性能表现、成本以及其制造可行性。
要理解OpenAI为什么涉足芯片设计,有必要考察其架构。Jalapeño是一个专用集成电路(ASIC)。与可以处理多种工作负载的GPU不同,ASIC针对更狭窄的用途进行了调优。这种更狭窄的关注点可以使其在特定AI任务上更便宜、更高效,尽管相比Nvidia风格的GPU适应性较低。在Jalapeño的情况下,OpenAI是从一个专注于现代LLM服务的全新设计开始的,而不是调整更广泛的加速器来适应其需求。该公司表示,该架构是基于其运营大规模AI产品的经验而设计的,旨在减少不必要的数据移动,同时更好地匹配计算、内存和网络资源。
Broadcom贡献了核心硅实现和网络技术,包括Tomahawk网络硅,而Celestica则协助进行板卡、机架和系统集成。目标是将芯片推向其在实际工作负载中的实际性能上限,而不仅仅是改进理论基准。
然而,OpenAI向专有硬件的转向不仅仅是对技术至高性的追求;它也可能使其核心单位经济学变得更加可持续。最近发布的审计财务文件显示,虽然OpenAI在2025年全年产生了令人印象深刻的130.7亿美元的收入,但其全年总运营支出膨胀到340亿美元,导致运营亏损近209.2亿美元。这种现金流失的主要罪魁祸首涉及纯粹的计算要求,尽管更多可能归因于训练而非推理。仅在2025年,研发成本——主要由训练和提供大规模语言模型所需的基础设施驱动——就占了191.8亿美元,约占公司整体支出的56%。OpenAI据报去年仅为R&D和计算基础设施就向微软支付了超过105.9亿美元。
尽管如此,当OpenAI为备受期待的2026年上市奠定基础时,Jalapeño推理芯片可能为私人投资者和公开市场提供了保证,即OpenAI有一个走向盈利的计划。如果它能降低AI推理的成本,它可能会收回在昂贵的训练运行上花费的一些损失。
"通过自己设计更多的堆栈,我们可以用更高的效率提供更多智能,并继续推动先进AI走向更广泛的应用," OpenAI总裁兼联合创始人Greg Brockman在Broadcom发布的一份声明中表示。
Jalapeño的推出立即引发了关于OpenAI在竞争激烈的半导体和GPU市场中战略定位的问题。自2022年底引发生成式AI热潮以来,OpenAI一直是GPU市场领导者Nvidia高端产品的最大客户之一,同时也从该公司获得了数十亿美元的投资,并扩大了与其他竞争芯片制造商的合作以满足其需求。
在2026年2月,Nvidia最终向OpenAI进行了300亿美元的直接投资,作为规模巨大的1100亿美元融资轮的一部分。该交易确保了部署10GW计算系统的协议——包括3GW专用推理容量和2GW训练容量——利用Nvidia的下一代Vera Rubin平台。作为同一2026年2月融资轮的一部分,亚马逊向OpenAI投资了500亿美元,包括OpenAI在未来八年内消费约2GW AWS专有Trainium计算容量的承诺。
OpenAI还与AMD签署了使用后者AMD Instinct MI450系列GPU的协议,并与Cerebras达成协议,Cerebras是一家AI芯片制造商,在2026年5月进行了首次公开募股。这个庞大的供应商协议网络突显了OpenAI基础设施雄心的巨大规模。OpenAI和Broadcom伙伴关系的最终目标涉及从2026年开始与Microsoft和其他合作伙伴部署千兆瓦级数据中心——即需要与城市规模相当的能源计算的数据中心。
对于Broadcom来说,该伙伴关系充当了一个巨大的声誉催化剂。该公司一直是生成式AI热潮的最大受益者之一,帮助超大规模公司和前沿实验室设计定制硅。Broadcom的股份反映了这一势头,在2026年上半年显示出18%的同比增长,以及自2022年底以来近7倍的涨幅。
最终,Jalapeño证实了OpenAI相信它已准备好从软件和代码进入真实世界的定制硬件领域。通过控制其推理管道的物理特性——同时利用Nvidia、亚马逊、AMD和Cerebras的资本和硬件——OpenAI正在尝试快速改写其AI的单位经济学。