2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页头条报道
头条 · 报道

OpenAI 发布了首款自研 AI 芯片,标志着其向内部硅片战略转型,直接挑战英伟达在加速器市场的统治地位。

OpenAI 进入定制硅片设计领域可能割裂 GPU 生态系统,并促使未来超大规模云厂商的资本支出转向非标准英伟达架构。
行业媒体Slicast · 2026年8月30日 · 美国 · 来源: WION
重要度 92

OpenAI 发布了 Jalapeño,这是其与博通(Broadcom)合作开发的首款定制 AI 推理芯片。这一发布标志着该公司战略的转变:如今,除了构建模型本身外,OpenAI 也开始设计运行其模型的硬件。首席执行官 Sam Altman 在一篇简短的帖子中总结了这一里程碑:“我们制造了一款芯片,而且它速度很快。”

据 OpenAI 称,在包括 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 1T 在内的基准测试中,Jalapeño 每瓦特处理的 AI 工作量比对比系统高出 1.5 倍至 1.9 倍。该芯片在内部测试中还实现了端到端延迟降低 1.7 倍至 3.6 倍。这些结果是与基于英伟达加速器构建的商业系统进行对比得出的,使用的是 InferenceX 基准测试。尽管根据测试配置的不同,英伟达对比系统的评级为 1,200W 或 1,400W,但 Jalapeño 的运行功率仅为 700W。对于高度交互式的 AI 工作负载,OpenAI 报告称性能提升高达 4.1 倍。然而,公司指出,这些是针对特定工作负载的自我报告基准测试结果,并不表明 Jalapeño 已在更广泛的 AI 计算领域取代英伟达。

Jalapeño 专为推理阶段打造——即 AI 模型处理和响应用户请求的阶段。这包括标准查询、编码代理、AI 助手以及 API 调用。OpenAI 没有追求通用处理器,而是专门针对这些推理工作负载设计了这款芯片。该公司与博通合作开发了硅片,并与 Celestica 合作完成了电路板、机架和生产系统。通过优化整个堆栈——包括芯片、内存、网络和软件——OpenAI 旨在解决两个关键的行业挑战:激增的计算需求和不断上升的电力成本。

OpenAI 计划到 2026 年底开始在自身的计算基础设施中部署 Jalapeño。重要的是,该公司将继续广泛部署英伟达和其他加速器,用于训练和推理任务。Jalapeño 是多代芯片计划的第一步。OpenAI 确认,第二代芯片已处于深度开发阶段,第三代芯片目前也在成型中。

值得注意的是,AI 本身在 Jalapeño 的创造过程中发挥了核心作用。利用 AI 工具探索实现方案、优化电路并加速工程与测试,OpenAI 从初始设计到流片仅用了九个月时间。总体目标很简单:在相同的功耗和硬件占用空间内提取更多的 AI 工作量。如果成功规模化,随着全球需求的持续激增,这种方法有望带来更快的 ChatGPT 响应、能力更强的 AI 代理以及降低的运营成本。

阅读原文