Monday, September 21, 2026
AI 인프라 · 뉴스 & 분석
반도체·하드웨어리포트
반도체·하드웨어 · 리포트

Intel은 HPC 및 AI 워크로드 최적화를 포함한 Ponte Vecchio GPU 아키텍처를 상세히 설명했습니다.

AI 인프라용 고성능 GPU 설계 분야에서 Intel의 경쟁력을 나타냅니다.
업계 전문지Slicast · 2022년 8월 23일 12:00 UTC · 글로벌 · 출처: theregister.com
중요도 70

Intel은 Hot Chips 컨퍼런스에서 Ponte Vecchio라는 코드명의 플래그십 데이터센터 GPU를 지금까지 가장 상세하게 공개했으며, 자체 내부 벤치마크에서 이 칩이 AMD의 MI250x를 능가하고 Nvidia의 곧 출시될 H100 GPU와 정면으로 경쟁할 수 있음을 보여주었습니다. 작년에 발표된 Ponte Vecchio는 AI/ML 및 HPC 애플리케이션을 위한 고성능 GPU를 제공하기 위한 Intel의 첫 번째 진지한 시도입니다. 이 칩은 실제로는 Intel의 Foveros 및 EMIB 패키징 기술을 조합하여 함께 접합한 메모리 및 컴퓨트 다이의 시리즈로, "스택"으로 구성되며, 각 액셀러레이터당 두 개의 스택이 있습니다. Intel Fellow Hong Jiang에 따르면, 이러한 스택은 애플리케이션 요구사항에 따라 GPU 다이 한 쌍처럼 동작하거나 단일 논리 다이처럼 동작할 수 있습니다. Intel은 Ponte Vecchio가 동일한 피크 FP32 및 FP64 성능을 허용하는 설계 선택을 기반으로 52 teraflops의 성능을 제공할 것이라고 주장하며, 이는 AMD의 47.9Tflop (FP64) MI250X를 약간 능가하고 H100의 60Tflops (FP64)에 거의 근접합니다. Intel은 또한 Nvidia의 tensor cores와 유사한 XMX 행렬 가속기의 성능에 대해 논의했으며, GPU가 단정밀도 행렬 계산에서 419Tflops의 성능을 제공할 것이라고 주장합니다.

Ponte Vecchio의 일부 성능은 64MB 레지스터 파일, 64MB L1 캐시, 408MB L2 캐시, 및 128GB HBM 메모리를 포함하는 대용량 캐시에 기인합니다. "이것은 HBM 메모리로 나가지 않고도 데이터를 다이에 유지하는 데 정말 도움이 됩니다"라고 Jiang이 말했습니다. Intel 및 Nvidia의 GPU 모두 호스트 연결을 위해 PCIe 5.0에 의존하므로, 이들을 AMD의 PCIe 4.0 기반 MI200 시리즈 GPU와 비교하는 것은 정확한 비교가 아닙니다. 새로운 PCIe 사양은 호스트에 대한 대역폭을 두 배로 제공하지만 Intel 또는 AMD의 차세대 CPU가 필요하며, 둘 다 아직 출시되지 않았습니다. Nvidia는 이번 가을에 출시되는 AMD의 Epyc 4 칩을 쉽게 선택하거나 자체 Grace CPU를 사용할 수 있지만, Intel은 모두 Intel 아키텍처에 고집하는 것으로 보이며, HotChips에서 두 개의 Sapphire Rapids Xeon Scalable 프로세서와 쌍을 이루는 네 개의 액체 냉각 Ponte Vecchio GPU를 1U 섀시에 공개했으며, 회사의 Xe Link 패브릭을 사용하여 최대 8개의 GPU를 단일 노드에 연결할 수 있습니다.

Intel은 Ponte Vecchio의 도착을 Q1 2023으로 연기했으며, 이는 예정된 출시보다 1년 반 이상 늦습니다. 한편, AMD는 2023년에 Instinct MI300 액셀러레이터를 출시할 예정이며, 이를 "첫 번째 데이터센터 APU"로 홍보하고 있으며, Zen 4 프로세서와 함께 CDNA 3 기반 GPU를 공동 패키징하고 MI250X에 비해 8배의 성능 개선을 주장하고 있습니다. Nvidia는 이번 봄 GTC에서 Arm 기반 Grace CPU와 GH100 GPU, 512MB의 LPDDR5X 및 80GB의 HBM3 메모리를 단일 1000W 패키지에 통합한 Grace-Hopper Superchip을 공개했습니다. 뒤지지 않으려는 Intel은 5월에 HBM 장착 Sapphire Rapids CPU와 Ponte Vecchio GPU 스택을 단일 패키지로 병합할 Falcon Shores XPU에 대한 유사한 계획을 발표했으며, "현재 플랫폼"에 비해 성능-와트당, 메모리 용량 및 대역폭에서 5배의 성능 개선을 주장하고 있습니다.

Ponte Vecchio는 Nvidia 및 AMD와의 경쟁에 직면해 있을 뿐만 아니라, 더 이상 지연될 경우 Rialto Bridge라는 코드명의 후속 제품에 의해 수명이 단축될 수 있습니다. Rialto Bridge는 내년부터 샘플링을 시작할 예정이며, Intel은 모듈당 전력 소비를 800W로 올리고 액체 냉각이 필요합니다. 적어도 한 명의 고객은 Ponte Vecchio의 도착을 간절히 기다리고 있습니다: 에너지부의 Argonne National Laboratory로, 이곳은 프로젝트를 괴롭혀온 엄청난 Intel 주도 지연을 제외하고는 Aurora 슈퍼컴퓨터에서 칩을 사용할 계획입니다.

원문 보기
Intel은 HPC 및 AI 워크로드 최적화를 포함한 Ponte Vecchio… · Slicast