OpenAI加入Google、Microsoft和Amazon的行列,开始部署定制Jalapeno芯片,进一步降低其在模型训练中对标准英伟达加速器的依赖。
OpenAI 最近推出了其首款定制人工智能处理器,命名为 Jalapeño(墨西哥辣椒),这标志着其在内部硅芯片开发方面迈出了重要一步,并加剧了对英伟达(Nvidia)在先进 AI 计算硬件领域近乎垄断地位的冲击。这款定制推理半导体旨在提供行业领先的速度和运营效率,使 OpenAI 与谷歌、亚马逊网络服务(AWS)、微软和 Meta 等科技巨头并列,共同致力于研发专有芯片以驱动大规模 AI 系统。Jalapeño 处理器是与半导体制造商博通(Broadcom)合作开发的,专门针对推理阶段进行了优化——即经过训练的模型执行任务和处理用户查询的阶段。
OpenAI 计划在今年年底前在其计算基础设施中部署 Jalapeño。该公司证实,工程团队已经在开发该芯片的第二代和第三代版本。
在全球数据中心扩张期间,得益于模型训练和日常推理中对 GPU 需求的增长,英伟达的市场估值大幅飙升。然而,市场分析师警告称,超大规模科技公司设计的硅芯片迅速普及,对英伟达的长期主导地位构成了日益增长的威胁,尤其是在推理领域。独立研究机构 SemiAnalysis 在 OpenAI 的开发设施内评估了该芯片的性能,发现 Jalapeño 在几乎所有测试基准中的每瓦性能均超越了英伟达的 Blackwell 架构。不过,分析师指出,这种直接比较有些不对称,因为 Jalapeño 采用了新一代 HBM4 内存,因此英伟达即将推出的 Rubin 平台才是更准确的对比对象。TrendForce 分析师 Fion Chiu 观察到,虽然 Jalapeño 将降低 OpenAI 在日常推理任务中对英伟达的依赖,但由于英伟达 GPU 具备灵活的可编程性和成熟的 CUDA 软件生态系统,它们在大规模模型训练和前沿 AI 工作负载中仍将不可或缺。
OpenAI 的芯片首秀反映了整个行业向定制专用集成电路(ASIC)加速转变的趋势。谷歌通过其张量处理单元(TPU)的扩展率先开启了这一转变,并继续在云网络上部署下一代 TPU,用于模型训练和实时推理。Meta 在正式达成协议部署由博通设计的千兆瓦级定制 AI 处理器作为其多吉瓦基础设施计划的一部分后,也紧随其后。Anthropic 承诺在未来十年内向 AWS 基础设施投入超过 1000 亿美元,其中包括亚马逊专有的 Trainium 处理器。与此同时,Cerebras、SambaNova、D-Matrix、Etched 和 Fractile 等新兴芯片制造商也在积极推进专门的 AI 加速器。