Nvidia Grace Blackwell Ultra Superchip 시스템이 GPU 클라우드 제공자 CoreWeave에서 프로덕션 배포됩니다.
Dell은 NVIDIA의 GB300 NVL72 플랫폼 기반 업계 최초 시스템을 선도적 AI 클라우드 서비스 제공업체인 CoreWeave에 납품했습니다. CoreWeave는 데이터센터 호스팅 제공업체 Switch와 함께 Blackwell Ultra 기반 클러스터를 배포했습니다. Dell과 CoreWeave의 초기 출시에는 72개의 NVIDIA Blackwell Ultra GPU, 36개의 Arm 기반 72코어 Grace CPU, 그리고 랙당 36개의 BlueField DPU를 갖춘 Dell Integrated Racks가 포함됩니다.
각 GB300 NVL72 랙은 1.1 ExaFLOPS의 밀집 FP4 추론 성능과 0.36 ExaFLOPS의 FP8 학습 성능을 제공하며, 이는 GB200 NVL 대비 50% 높은 수치입니다. 각 GB300 NVL72 랙은 20TB의 HBM3E와 40TB의 총 RAM을 갖추고 있습니다. 새로운 랙 규모 솔루션은 NVIDIA의 Quantum-X800 InfiniBand 스위치와 ConnectX-8 SuperNIC을 활용하여 초당 최대 14.4GB의 스케일아웃 연결을 제공하며, 이는 이전 속도의 두 배입니다. 학습과 추론 성능을 극대화하도록 설계된 이들 밀집 구성 시스템은 GPU당 최대 1,400W의 극도의 전력 소비로 인해 액체 냉각 방식을 사용합니다.
Dell은 "NVIDIA GB300 기반 솔루션의 이번 납품은 단순한 이정표 이상입니다. 이는 고객과 파트너가 우리의 전문성에 지속적으로 보여주는 신뢰를 반영합니다. 컴퓨팅, 네트워크, 스토리지를 한 지붕 아래에서 원활하게 통합하고 통합 및 배포 서비스로 세부 조정함으로써, 우리는 고객이 전례 없는 속도와 규모로 나아갈 수 있도록 지원합니다"라고 말했습니다. Dell은 랙 규모 시스템이 완전히 조립 및 테스트되어 생산 환경에서의 빠른 설치 및 배포를 위해 설계되었다고 언급했습니다. 이는 Dell과 CoreWeave가 업계에 앞서 NVIDIA의 최신 AI GPU 플랫폼을 배포한 것이 두 번째입니다.
이번 배포를 통해 CoreWeave는 클라우드 플랫폼을 개선하여 더욱 고급의 대규모 언어모델 학습, 추론 프로세스 및 추론을 처리할 수 있게 됩니다. CoreWeave가 더 많은 GB300 NVL72 기반 랙을 도입함에 따라 고객에게 제공할 수 있는 총 성능이 증가할 것입니다. Dell과 CoreWeave는 첫 GB200 NVL72 머신을 배포한 지 약 7개월 후 GB300 NVL72 랙을 배포했으며, 이는 클라우드 서비스 제공업체 사이에서 NVIDIA의 고성능 Blackwell Ultra 시스템에 대한 강한 수요를 시사합니다.