Nvidia가 시스템 수준의 컴퓨팅 최적화를 위해 Intel Sapphire Rapids CPU를 DGX H100 시스템에 통합합니다.
엔비디아가 인텔의 차세대 Xeon Scalable 프로세서 Sapphire Rapids를 차기 DGX H100 AI 시스템의 CPU로 선정했다고 CEO Jensen Huang이 화요일 BofA Securities 2022 Global Technology Conference에서 확인했다. DGX H100은 엔비디아의 새로운 Hopper 아키텍처 기반 H100 GPU 8개를 탑재하며, 4세대 NVLink 인터커넥트로 연결되어 FP8 포맷으로 32 petaflops의 AI 성능을 제공할 수 있다. 해당 시스템은 2022년 말까지 출시될 예정이다. Huang은 다음과 같이 말했다: "우리는 많은 x86을 구매한다. 우리는 인텔과 AMD와 훌륭한 파트너십을 갖고 있다. Hopper 세대의 경우, Nvidia Hopper의 CPU로 Sapphire Rapids를 선택했으며, Sapphire Rapids는 뛰어난 단일 스레드 성능을 갖추고 있다. 그리고 우리는 전 세계의 하이퍼스케일러를 위해 이를 검증하고 있다. 전 세계의 데이터센터를 위해 검증하고 있다. 우리 자신의 서버, 우리 자신의 DGX를 위해 검증하고 있다. 우리 자신의 슈퍼컴퓨터를 위해 검증하고 있다."
Sapphire Rapids의 선정은 2020년 도입된 DGX A100 시스템에 AMD의 2세대 Epyc 서버 CPU인 Rome을 선택한 엔비디아의 이전 결정에서의 일탈이다. 업계 매체 ServeTheHome은 4월 중순에 엔비디아가 DGX H100을 위해 Sapphire Rapids와 AMD의 차기 Epyc CPU인 Genoa의 마더보드 설계를 모두 유지했다고 보도했으며, 이는 그 시점에 결정이 아직 확정되지 않았음을 의미했다. 인텔이 이를 기술 리더십 회복 노력의 승리로 주장할 수 있지만, 더 광범위한 경쟁 환경은 이를 엔비디아, 인텔, AMD 및 기타 기업 간의 GPU와 가속기를 둘러싼 더 큰 전투에서의 상대적으로 작은 승리로 드러낸다. 이는 인텔이 차기 Ponte Vecchio GPU에 대규모 투자를 하도록 하고 AMD가 최신 Instinct GPU로 경쟁력을 강화하도록 자극한다.
DGX H100 결정을 넘어, 엔비디아의 전략적 초점은 CPU와 GPU를 단일 패키지에 결합하여 AI 워크로드와 까다로운 애플리케이션의 데이터 흐름을 가속화하도록 설계된 자체 Arm 호환 CPU인 Grace로 이동하고 있다. 엔비디아는 내년에 144코어 CPU 전용 Grace Superchip과 함께 Grace Hopper Superchip을 도입할 계획이며, 그 후 새로운 DGX 시스템이 뒤따를 것으로 예상된다. Huang은 "Grace는 놀라운 CPU가 될 것"이라고 강조하며, 이를 통해 엔비디아는 컴포넌트, 시스템, 소프트웨어를 엔드-투-엔드로 최적화할 수 있을 것이라고 말했다. 이 아키텍처는 하이퍼스케일 기업이 사용하는 추천 시스템과 대규모 언어 모델용으로 설계되었지만, Huang은 더 광범위한 애플리케이션이 계획 중임을 시사했다. Huang은 다음과 같이 말했다: "Grace의 이점은 우리가 진입하는 모든 단일 애플리케이션 영역—데이터 분석, 머신러닝, 클라우드 게이밍, Omniverse, 또는 디지털 트윈 시뮬레이션 등—에서 우리는 전체 스택을 보유하고 있으며 생태계 전체가 정렬되어 있다는 것이다. Grace를 전개할 모든 영역에서 우리는 전체 스택을 소유하고 있으므로, 우리는 그것을 위한 시장을 창출할 수 있는 기회를 갖고 있다." 인텔도 서버용 자체 CPU-GPU 설계인 Falcon Shores XPU를 2024년에 도입할 계획이다.