OpenAI 和 Broadcom 发布 Jalapeño 自定义 AI 推理芯片,号称推理成本降低 50%,针对吉瓦级规模数据流动优化。
运营ChatGPT成本最高的部分从来都不是工程师或办公室——而是芯片,绝大多数是英伟达制造的芯片,按照英伟达的价格购买,消耗速度之快使得计算支出成为OpenAI最大的运营成本之一。周三,OpenAI给自己提供了希望这是一个开始的出路。
OpenAI和博通推出了Jalapeño,这是OpenAI的首款定制AI加速器。这款芯片由OpenAI的工程团队从零开始设计,由台积电制造,专为推理工作负载而构建——即向ChatGPT、Codex、OpenAI API的用户以及公司所称的下一代代理AI产品提供经过训练的模型响应。这不是一款训练芯片。它不试图成为通用芯片。它在OpenAI运营的规模上只做一件事,尽可能高效地完成。
早期实验室测试显示Jalapeño在性能上与英伟达的Blackwell处理器和Google的张量处理单元相当,但推理token成本约低50%。如果这些数字能够维持,这将是很重要的数据。包含基础数据的技术报告尚未发布。OpenAI表示将在"未来数月内"发布。
OpenAI总裁格雷格·布罗克曼在与CEO萨姆·奥特曼一起从博通CEO胡克·谭和总裁查理·卡瓦斯的交接仪式中获得首批晶圆后,在讲话中强调了基础设施控制的重要性。"通过更多地自己设计技术栈,我们可以以更高的效率提供更多的智能能力,并继续推动先进AI走向更广泛的应用,"布罗克曼对CNBC表示。这款芯片从初始设计到制造流片用了9个月,OpenAI和博通将其描述为高性能AI半导体领域迄今实现的最快时间表。设计过程的部分内容是使用OpenAI自己的AI模型加速完成的。
AI推理工作负载现在占AI数据中心计算的三分之二,而这个工作负载的经济学正是Jalapeño的目标。AI内存芯片全年供应紧张,因为推理部署的需求激增。英伟达上月进行的250亿美元债券发行(该公司五年来的首次债务发行)表明,即使是AI繁荣最大的受益者也在争相扩大产能。Jalapeño是OpenAI迄今为止最直接的尝试,旨在减少对该供应链的依赖。
OpenAI现在加入了多年来一直在开发定制硅芯片的公司行列。Google拥有张量处理单元,Amazon拥有Trainium,Meta也在开发自己的推理硅芯片。但这种比较只是部分地反映了Jalapeño代表什么。那些芯片是由超大型科技公司为外部云客户构建的。OpenAI正在为自己的产品和自己的用户构建一款芯片,这家曾作为研究非营利机构起步的公司如今正致力于科技行业最资本密集的工程计划之一。
胡克·谭表示与OpenAI的合作"使得从2026年开始与微软和其他合作伙伴部署千兆瓦级数据中心成为可能"。千兆瓦级是AI行业用来描述最大规模基础设施建设项目的测量单位。Jalapeño对生产需求的影响以及台积电需要实现的制造良率目前尚未披露。Celestica正在处理板卡和机架集成。各公司将Jalapeño描述为多代计算平台的第一步,初期部署目标是2026年底。
这款芯片的架构专门为大型语言模型推理而设计,而不是从训练加速器或通用处理器改编而来的。这一设计选择反映了AI行业正在经历的结构性转变:从构建模型转向以巨大规模廉价运行模型。OpenAI与埃隆·马斯克旗下xAI今年的法律诉讼使得该公司备受争议的战略决策更加引人注目。这一决策涉及的是不仅在今年而且无限期地以这种规模运营的经济学。
OpenAI和博通都没有提供任何使读者能够独立评估50%成本声明的内容。没有公开的方法论。没有第三方基准测试结果。没有来自台积电的良率数据。Jalapeño是一款首代芯片,从未在生产环境中运行过,更不用说其制造商已经在描述的千兆瓦级规模了。从周三起,存在的只是潜力。芯片已被交接。证据仍在书写中。