Nvidia, Intel, AMD가 Computex 2024에서 주요 AI 칩 및 인프라 기술 공개
대만에서 열린 Computex 2024에서 엔비디아(Nvidia), 인텔(Intel), AMD는 반도체 산업이 가속화된 개발의 새로운 시대에 진입하고 있음을 시사하는 주요 발표들을 내놓았다. 엔비디아 CEO 젠슨 황(Jensen Huang)은 향후 데이터 센터를 위한 새로운 GPU, CPU 및 기타 칩들의 확장된 로드맵을 공개했다. AMD CEO 리사 수(Lisa Su)는 올해 말 출시될 288GB Instinct MI325X GPU로 시작되는 확장된 데이터 센터 가속기 칩 로드맵과 함께 AI 지원 노트북용 Ryzen AI 300 칩, Ryzen 9000 데스크톱 시리즈, 그리고 192코어 EPYC "Turin" 프로세서 출시 계획을 발표했다. 인텔 CEO 팻 겔싱어(Pat Gelsinger)는 새로운 Xeon 6 E-core CPUs, AI 지원 PC를 위한 차기 Lunar Lake 프로세서를 발표했으며, 인텔의 차기 Gaudi 3 AI 칩에 대한 생태계 동력과 플랫폼 가격 정보를 공유했다. 또한 엔비디아는 Blackwell GPU용 MGX 모듈러 디자인의 확장, NIM 추론 마이크로서비스의 출시, 그리고 RTX GPU 기반 PC에서의 AI 애플리케이션 개발 강화 계획을 발표했다.
엔비디아는 매년 새로운 데이터 센터 GPU 아키텍처를 출시하는 공격적인 전략을 제시했으며, 이는 이전의 2년 주기의 출시 사이클보다 가속화된 것이다. 황 회장은 "우리의 기본 철학은 매우 단순하다. 데이터 센터 규모 전체를 구축한 후 분해하여 1년 주기로 부품 단위로 판매하며, 모든 것을 기술적 한계까지 밀어붙인다"고 밝혔다. 이 로드맵은 2022년 Hopper 아키텍처 대비 대규모 AI 모델의 추론 성능을 최대 30배 향상시키고 에너지 소비를 25배 절감할 수 있는 Blackwell 아키텍처를 3월에 발표한 데 이어 나온 것이다. 2025년 엔비디아는 황 회장이 "기술적 한계까지 밀어붙였다"고 설명한 Blackwell Ultra와 업데이트된 Spectrum Ultra X800 이더넷 스위치를 출시할 계획이다. 2026년에는 Arm 기반 Grace 아키텍처에 이어 두 번째 세대의 CPU인 Vera와 함께 HBM4 메모리를 사용하는 완전히 새로운 GPU 아키텍처인 Rubin을 debut할 예정이다. 또한 칩 간 대역폭을 3600 GBps로 두 배로 늘린 NVLink 6 Switch, 1600 GBps 처리가 가능한 CX9 SuperNIC, 그리고 InfiniBand 및 이더넷 스위치의 X1600 세대도 선보일 예정이다. 황 회장은 "여기서 제가 보여드리는 모든 칩들은 모두 본격적으로 개발 중이며, 100% 기술적 한계 내에서 1년 주기를 유지하고 있으며, 아키텍처적으로 100% 호환된다"고 강조했다.
엔비디아는 MGX 모듈러 참조 설계 플랫폼을 통해 서버 벤더들이 선호하는 GPU, CPU 및 데이터 처리 장치 조합을 선택하여 "100개 이상의 시스템 설계 구성을 빠르고 비용 효율적으로 구축"할 수 있도록 지원한다. 새로 공개된 GB200 NVL2 단일 노드 서버 설계는 기존 데이터 센터에 통합하기 위해 두 개의 Blackwell GPU와 두 개의 Grace CPU를 포함한다. MGX 플랫폼은 B100 GPU, B200 GPU, GB200 Grace Blackwell 슈퍼칩, GB200 NVL72 등 다른 Blackwell 기반 제품들도 지원하며, 인텔의 차기 Xeon 6 P-core 프로세서와 AMD의 차기 EPYC "Turin" 프로세서도 지원할 예정이다. 양사는 이번이 처음으로 "자체 CPU 호스트 프로세서 모듈 설계"를 계획하고 있다. AMD는 새로운 Zen 5 아키텍처를 사용한 차세대 Ryzen 9000 데스크톱 프로세서를 공개했으며, 플래그십인 16코어 Ryzen 9 9950X는 7월부터 출하될 예정이다.