CoreWeave가 Nvidia의 차세대 Vera Rubin NVL72 플랫폼 배포를 주도 중
CoreWeave는 6월 1일 보도자료를 통해 CoreWeave Cloud에서 NVIDIA Vera Rubin NVL72의 산업 최초 빌드 및 시스템 레벨 검증을 완료했다고 발표했습니다. CoreWeave의 발표에 따르면 NVL72 랙에는 72개의 GPU와 36개의 CPU가 포함되어 있으며, 260 TB/s 6세대 인터커넥트 패브릭으로 장착되어 있습니다. 회사는 이 플랫폼이 대규모 추론, 에이전틱 AI, 지속적 추론 워크로드를 위해 설계되었다고 밝혔습니다. 보도자료와 CoreWeave 블로그는 랙 스케일 설계에 성능 및 효율성 개선을 돌렸으며, Jane Street의 Craig Falls의 반복 속도 개선에 관한 의견을 인용했습니다. DatacenterDynamics와 SiliconANGLE은 Michael Dell의 LinkedIn 확인과 에이전틱 워크로드가 확대됨에 따라 클라우드 제공자, 플랫폼 운영자, 인프라 공급자 간의 협업 엔지니어링에 관한 theCUBE Research 분석가들의 의견을 인용하며 보도를 보충했습니다.
CoreWeave는 6월 1일 보도자료를 통해 CoreWeave Cloud에서 NVIDIA Vera Rubin NVL72의 산업 최초 빌드 및 시스템 레벨 검증을 완료했다고 발표했습니다. 회사의 문서 및 블로그 기사에 따르면 NVL72 랙은 72개의 GPU와 36개의 CPU를 통합하며 260 TB/s 6세대 인터커넥트 패브릭을 사용하여 랙 스케일 연결 대역폭을 달성합니다. CoreWeave의 발표는 배포가 추론 집약적, 에이전틱 AI 워크로드 및 지속적 추론 세션을 대상으로 한다고 위치시킵니다. DatacenterDynamics와 SiliconANGLE은 Michael Dell이 LinkedIn 게시물을 통해 CoreWeave용 액냉식 Dell PowerEdge XE9812의 납품을 확인했다고 보도했으며, SiliconANGLE은 더 넓은 인프라 영향에 관한 theCUBE Research 수석 분석가의 의견을 인용했습니다.
CoreWeave의 보도자료에 따르면 Vera Rubin NVL72 구성은 완전히 액냉식이며, 케이블 없는 모듈식 트레이를 채택하고 있으며, 랙 스케일 운영을 위한 '엄격한 시스템 레벨 검증'을 완료했습니다. 자료에 따르면 랙 스케일 메트릭에는 추론당 와트당 최대 10배의 성능 개선이 포함되며, 이전 세대와 비교하여 GPU 수와 백만 토큰당 비용이 모두 감소했습니다. DatacenterDynamics는 NVIDIA가 Rubin이 Blackwell 세대와 비교하여 약 5배의 추론 및 3.5배의 학습 성능 개선을 제공한다고 주장했다고 보도했습니다. CoreWeave의 블로그 및 보도 자료는 또한 클러스터 레벨 텔레메트리 및 대규모 추론 클러스터를 위해 맞춤화된 지원 엔지니어링을 포함하여 관찰성 및 운영 기능을 강조합니다.
편집 분석: 공개 보도는 이 이정표를 더 넓은 '신규 클라우드' 이니셔티브 및 벤더 협업 엔지니어링 노력의 일부로 위치시키며, 여기서 1차 클라우드 제공자 및 OEM 파트너들이 차세대 랙 스케일 시스템을 검증합니다. 추론 중심 및 에이전틱 워크로드를 위해 구축하는 회사들은 지연 시간 및 토큰당 에너지 소비를 줄이기 위해 액냉식, 고대역폭 인터커넥트 및 통합 DPU/SuperNIC을 점점 더 우선순위합니다. SiliconANGLE에 인용된 관찰자들은 하드웨어 및 플랫폼 엔지니어링의 이 조합이 지속적 추론 및 대규모 컨텍스트 워크로드의 총소유비용 감소를 목표로 한다고 믿습니다.
편집 분석: 머신러닝 엔지니어 및 인프라 팀의 경우, 검증된 NVL72 랙은 더 접근하기 쉬운 랙 스케일 추론 용량과 더 높은 와트당 토큰 처리량을 의미합니다. 실제로 이는 순수 GPU 수에서 랙 레벨 냉각, 네트워크 패브릭 설계 및 데이터 이동 및 텔레메트리를 지원하기 위한 DPU 오프로딩으로 일부 운영 초점을 전환합니다. 지속적 에이전트 또는 매우 긴 컨텍스트 추론을 평가하는 팀은 벤치마킹 계획 및 비용 모델링에서 랙 스케일 시스템 특성을 고려해야 합니다.
편집 분석: 관찰자들은 벤더 주장을 넘어선 독립적 벤치마킹, 클라우드 제공자 전반의 더 광범위한 가용성, 소프트웨어 스택이 백만 토큰 컨텍스트 및 지속적 세션에 어떻게 적응하는지를 추구할 것입니다. 주요 메트릭에는 Vera Rubin 하드웨어의 MLPerf 추론 결과, DPU/SuperNIC과 오케스트레이션 및 보안 도구의 통합, 실제 토큰 비용 및 지연 시간 개선을 보고하는 고객 사례 연구가 포함됩니다.
DatacenterDynamics는 Michael Dell의 LinkedIn 댓글 '세계 최초의 Nvidia Vera Rubin NVL72 서버 랙이 여기 있습니다'를 Dell에 귀속시켜 재게시했습니다. CoreWeave의 보도자료에는 Jane Street의 정량적 연구 책임자 Craig Falls로부터의 고객 인용문이 포함되어 있으며, 이전 NVIDIA 세대 전반에 걸쳐 확장할 때의 성능 및 지원 이점을 설명합니다.
편집 분석: 벤더 자료는 성능 및 비용 데이터를 선보입니다. 독립적 검증 및 제3자 벤치마킹은 특정 워크로드에 대한 실제 이점을 정량화하는 데 필요합니다.