Tuesday, September 22, 2026
AI 인프라 · 뉴스 & 분석
반도체·하드웨어리포트
반도체·하드웨어 · 리포트

Intel Gaudi AI 프로세서와 Nvidia GPU의 데이터센터 배포를 위한 비교 기술 분석

Intel의 경쟁적 AI 가속기 시장 복귀를 검증하고, Nvidia의 가격-성능에 압박을 가하며 데이터센터 운영자들이 대안을 평가하도록 강제
업계 전문지Slicast · 2024년 6월 13일 12:00 UTC · 글로벌 · 출처: nextplatform.com
중요도 68

이완 타이페이에서 열린 Computex IT 컨퍼런스에서 Intel은 Gaudi 2 및 Gaudi 3 가속기의 정가를 공개했습니다. 이는 Nvidia나 AMD가 아직 하지 않은 것입니다. Intel은 경쟁력 있는 성능을 입증하는 벤치마크 결과와 함께 이를 발표했습니다. Intel은 이 투명성 전략을 통해 향후 AI 가속기에 대한 가치 입지를 구축하면서 동시에 2025년 말 "Falcon Shores" 및 2026년 "Falcon Shores 2" 출시 자금을 조달할 판매를 창출하려고 합니다. 4월에 출시된 Gaudi 3 칩은 Intel이 2019년 12월 Habana Labs를 20억 달러에 인수하면서 시작된 Gaudi 라인의 끝을 나타냅니다.

Falcon Shores는 Intel의 기존 AI 컴퓨팅과 미래 AI 컴퓨팅 사이의 기술적 교량입니다. Intel이 2023년 6월 공개한 바와 같이, Falcon Shores는 Gaudi 라인의 대규모 병렬 Ethernet 패브릭 및 매트릭스 수학 연산 유닛을 Ponte Vecchio용으로 개발된 Xe GPU 엔진과 통합하여 64비트 부동소수점 연산과 매트릭스 수학 처리를 동시에 가능하게 할 것입니다. 이는 Ponte Vecchio가 갖지 못한 기능으로, AI 워크로드에 대한 매력을 제한합니다. Falcon Shores는 1,500와트의 전력을 소비할 것이며, 이는 Nvidia의 최고급 "Blackwell" B200 GPU의 1,200와트보다 25% 더 많은 전력을 사용합니다. B200은 FP4 정밀도에서 20 petaflops의 성능을 제공합니다. Intel은 충분한 성능 향상을 달성하기 위해 2025년 생산 예정인 Intel 18A 공정을 사용해야 하며, Falcon Shores 2는 2026년에 예정된 더 미세한 Intel 14A 공정을 목표로 합니다.

Intel의 벤치마크 데이터는 Gaudi 3를 현재 Nvidia 하드웨어와 경쟁력 있게 배치합니다. 훈련의 경우, Intel은 1,750억 개의 매개변수를 가진 GPT-3 및 700억 개의 매개변수를 가진 Llama 2에 대한 성능을 입증했습니다. GPT-3 테스트는 8,192개의 가속기로 구성된 클러스터에서 실행되었으며, Intel Gaudi 3는 128GB HBM, Nvidia H100은 80GB HBM을 사용했습니다. Llama 2 테스트는 64개의 디바이스로 구성된 머신에서 실행되었습니다. 추론의 경우, Intel은 여러 모델 구성에서 Gaudi 3(128GB HBM)을 H100(80GB HBM)과 H200(141GB HBM) 모두와 비교하여 제시했습니다.

Intel의 상업적 의도는 분명합니다. 회사는 10월에 Gaudi 가속기 판매로 20억 달러의 파이프라인을 명시했고, 4월에 2024년 Gaudi 가속기 판매로 5억 달러를 기대한다고 추가했습니다. 이는 AMD의 올해 예상 40억 달러 GPU 판매 및 Nvidia의 예상 1,000억 달러 이상의 데이터센터 컴퓨트 수익과 비교하면 미미하지만, 20억 달러 파이프라인을 확보하는 것은 Falcon Shores 및 Falcon Shores 2의 자금 조달에 필수적입니다. TSMC가 끊임없는 혁신을 지속하고 Nvidia가 2025년 Blackwell Ultra와 2026년 Rubin으로 로드맵을 진행하면서, Intel은 파운드리 및 칩 설계 사업 모두에서 실행 능력을 입증해야 하는 점증하는 압력에 직면해 있습니다.

원문 보기
Intel Gaudi AI 프로세서와 Nvidia GPU의 데이터센터 배포를 위한… · Slicast