2026年9月15日星期二
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

OpenAI与Broadcom推出Jalapeño,一款为千兆瓦级部署设计的定制AI推理芯片,推理成本为现有方案的一半。

OpenAI直接进入芯片设计表明AI基础设施向纵向整合的转变;推理成本对等解锁了新的工作负载经济学。
行业媒体Slicast · 2026年6月25日 UTC 17:53 · 美国 · 来源: HotHardware
重要度 95

OpenAI多年来一直购买他人的芯片,但它刚刚展示了自己的芯片,代号相当有看头。该公司与Broadcom合作发布了Jalapeño,一款专为推理设计的定制AI芯片。在一场既彰显意图又富有宣传意义的活动中,Broadcom首席执行官何庭波(Hock Tan)走进OpenAI办公室,将第一块晶圆交给了Sam Altman和Greg Brockman。

在租用硬件上大规模运行ChatGPT成本高昂,而且大部分硬件都来自一家供应商。依赖NVIDIA的GPU到目前为止效果不错,但这让OpenAI在每个查询上支付溢价,同时与整个行业争夺供应。定制芯片有助于解决这两个问题。

OpenAI构建了一个异常大型的计算单元,并配合高带宽内存来最大化计算、最小化数据移动,确保这些核心处理器有充足的数据。TSMC据称制造该芯片,Broadcom负责硅实现和网络设计,Celestica负责制造服务器机架。

开发时间令人咋舌。高性能芯片采用先进工艺节点制造通常需要两到三年从概念到流片。Jalapeño据称仅用了九个月。OpenAI利用自己的模型来协助完成布局和优化,工程样品已经在实验室中运行,包括一个运行GPT-5.3-Codex-Spark模型的样品。

泄露的财务数据显示OpenAI去年收入约为130.7亿美元,运营亏损接近209亿美元。最近发布的OpenAI研究发现,其最活跃的内部用户现在每天累计运行超过60小时的Codex代理工作——正是Jalapeño为之构建的令牌密集型工作负载。

Broadcom首席执行官何庭波表示早期样品相比典型AI GPU将推理成本降低约50%,他告诉一个信息源激增的需求可能会让该合作伙伴关系的表现超过他早期的部署预测。OpenAI硬件主管Richard Ho称Jalapeño为"一个非常通用的设备",针对语言模型进行了优化。到目前为止,所有性能数据都是自报的,完整的技术报告承诺在今年晚些时候发布。

OpenAI仍然严重依赖NVIDIA GPU进行训练,任何芯片的优劣取决于其供应链的支持。Jalapeño是计划中多代产品的第一个,据报下一个版本将在2028年推出,之后每年更新。

阅读原文
OpenAI与Broadcom推出Jalapeño,一款为千兆瓦级部署设计的定制AI推理芯片,… · Slicast