NVIDIA Rubin CPX 사양: 최대 128GB GDDR7 메모리, 30 PFLOPs FP4, 백만 토큰 컨텍스트 및 생성형 AI 추론 최적화.
NVIDIA는 차세대 Rubin AI 플랫폼에 대한 새로운 세부 정보를 발표했으며, 대규모 컨텍스트 처리를 위해 특별히 설계된 GPU인 Rubin CPX를 공개했습니다. Rubin CPX는 AI 시스템이 백만 토큰 규모의 소프트웨어 코딩과 생성형 비디오를 획기적인 속도와 효율로 처리할 수 있도록 합니다. 이 칩은 단일 설계에서 비디오 디코더 및 인코더를 긴 컨텍스트 추론 처리와 통합하여, 비디오 검색 및 고품질 생성형 비디오와 같은 긴 형식 응용 프로그램에 대한 전례 없는 기능을 제공합니다.
Rubin CPX는 새로운 Vera Rubin NVL144 CPX 플랫폼 내에서 NVIDIA Vera CPU 및 Rubin GPU와 함께 작동하며, 이는 8 exaflop의 AI 컴퓨팅 성능을 갖춘 통합 MGX 시스템입니다. 이는 NVIDIA의 GB300 NVL72 시스템보다 7.5배 더 높은 AI 성능을 나타내며, 단일 랙에서 100TB의 고속 메모리 및 1.7 petabytes per second의 메모리 대역폭을 제공합니다. 플랫폼은 또한 GB300 NVL72보다 3배 높은 Attention 성능을 제공합니다. 기존 Vera Rubin 144 시스템을 재사용하려는 고객을 위해 개별 Rubin CPX 컴퓨팅 트레이도 사용 가능합니다.
Rubin CPX GPU는 30 PFLOPs의 NVFP4 AI 컴퓨팅 성능을 제공하며 최대 128GB의 GDDR7 메모리를 탑재합니다. NVIDIA는 비용 효율성을 위해 HBM보다 GDDR7을 선택했습니다. 이 칩은 이전 세대 대비 4배의 NVENC 및 NVDEC 기능을 갖추고 있으며, 생성형 AI 작업을 지원하기 위해 확장된 비디오 처리 기능을 제공합니다. 강력한 NVFP4 컴퓨팅 리소스를 갖춘 비용 효율적인 모놀리식 단일 다이 설계로 구축된 Rubin CPX는 AI 추론 작업에서 극도로 높은 성능과 에너지 효율성을 위해 최적화되었습니다.
비교하면, non-CPX Vera Rubin NVL144 플랫폼은 4개의 Rubin GPU와 2개의 Vera CPU를 갖추고 있으며, 3.6 Exaflops의 NVFP4 컴퓨팅, 1.4 PB/s의 HBM4 대역폭, 그리고 75TB의 용량을 제공합니다. Vera Rubin CPX 플랫폼은 Grace Blackwell 플랫폼과 비교하여 7.5배 높은 AI 컴퓨팅, 3.0배 높은 대역폭, 4.0배 높은 메모리(GDDR7의 150TB)를 제공합니다. 표준 Rubin 플랫폼은 2-reticle 크기의 GPU를 특징으로 하고 Rubin Ultra는 4-reticle 크기의 GPU를 특징으로 하는 반면, CPX 칩은 단일 다이 및 모놀리식 구성을 채택합니다. NVIDIA는 첫 번째 Rubin CPX 시스템이 2026년 말까지 사용 가능할 것으로 예상하며, Vera Rubin은 곧 생산에 들어갈 것으로 예상되고 GTC 2026에 정식 공개가 계획되어 있습니다.