OpenAI와 Broadcom은 Jalapeño를 공개했으며, 대규모 LLM 추론을 최적화하기 위해 9개월 개발 주기로 설계된 커스텀 추론 프로세서입니다.
OpenAI와 Broadcom이 수요일에 첫 번째 커스텀 AI 칩을 발표했으며, 이는 9개월간의 개발 스프린트를 완료했고 ChatGPT 제작사의 실리콘 설계 진출을 나타내며 Nvidia의 AI 컴퓨팅 지배력에 대한 지금까지 가장 직접적인 도전을 의미합니다.
Jalapeño라고 명명된 이 칩은 사용자 프롬프트에 대응하여 훈련된 AI 모델을 실행하는 프로세스인 추론용으로만 독점적으로 설계된 애플리케이션별 집적 회로(ASIC)입니다. 이는 훈련용으로 설계되지 않았습니다. 이 구분은 의도적입니다: OpenAI의 2026년 2월 Nvidia에 대한 300억 달러 투자는 Nvidia의 Vera Rubin 플랫폼의 10기가와트 배치 계약과 결합하여, GPU 거인을 훈련 인프라의 중심에 유지합니다.
파트너십은 2025년 10월에 공개적으로 발표되었습니다. 8개월 후, 실제 칩들이 데이터 센터로 이동 중입니다.
OpenAI 대표 Greg Brockman은 CNBC의 David Faber에게 회사의 자체 AI 모델이 설계 프로세스를 크게 가속화했다고 말했습니다. "우리 모델이 이를 가속화할 수 있었던 정도는 우리를 매우 놀라게 했습니다"라고 그는 말했습니다. OpenAI는 최첨단 GPT-5.5가 아닌 이전 세대 모델을 사용하여, 소프트웨어-하드웨어 피드백 루프를 통해 일반적으로 몇 년이 걸리는 것을 9개월 주기로 압축했습니다.
초기 테스트에 따르면 Jalapeño는 회사의 발표에 따르면 "현재 최첨단보다 와트당 성능이 상당히 우수합니다"라고 합니다. Brockman은 X에 "와트당 성능이 정말 좋아 보입니다"라고 작성했습니다. OpenAI는 이미 테스트 환경에서이지만 프로덕션 워크로드에서 칩에서 실행되는 GPT-5.3-Codex-Spark를 테스트했습니다.
Broadcom은 실리콘을 제조하고 Tomahawk 네트워킹 기술을 제공합니다. Celestica는 보드, 랙 및 시스템 통합을 담당합니다.
OpenAI는 올해 말까지 활성 데이터 센터 전역에 Jalapeño를 배포할 계획이며, 추가 세대가 뒤따를 것입니다. 경제 상황은 시급합니다. 2025년에 OpenAI는 340억 달러의 지출에 대비해 130.7억 달러의 수익을 창출했으며, 약 209.2억 달러의 운영 손실을 기록했습니다. 컴퓨팅 인프라에 의해 주도된 연구 개발 비용은 191.8억 달러를 소비했으며—총 지출의 약 56%—회사는 R&D 및 컴퓨팅만으로 Microsoft에 105.9억 달러 이상을 지불했습니다.
Jalapeño는 OpenAI의 이 비용 곡선을 구부리려는 시도이며, 타이밍은 많이 기대되는 기업공개(IPO)와 일치합니다.
Broadcom CEO Hock Tan은 CNBC에 회사의 6개 고객의 컴퓨팅 수요가 "도저히 감당할 수 없을 정도로 크다"고 말했습니다. "그것은 우리가 해결할 수 있는 것보다 훨씬 많습니다"라고 그는 말했으며, "이것은 단지 '26만이 아니고 '27만도 아닙니다. 우리는 '28에서도 같은 수준, 심지어 더 높은 수요를 보고 있습니다."
Broadcom 주식은 수요일에 1% 이상 상승했습니다. 주식은 2026년에 10% 상승했으며 2022년 말 이후 거의 7배 증가했습니다.
Jalapeño는 Google의 TPU, Amazon의 Trainium, Microsoft의 Maia 200, Meta의 MTIA 라인업에서 커스텀 AI 실리콘의 증가하는 물결에 합류합니다. OpenAI는 하드웨어 제어가 더 이상 선택사항이 아니라 지속 가능한 경제학을 위한 유일한 경로라고 결론 내린 최신 소프트웨어 회사입니다.
"더 많은 스택을 우리 자신이 설계함으로써, 우리는 더 큰 효율성으로 더 많은 지능을 제공할 수 있고 고급 AI를 더 광범위한 접근으로 계속 밀어붙일 수 있습니다"라고 Brockman은 성명에서 말했습니다.