GPU 클라우드 제공자 OpenMetal은 프라이빗 서버 배포를 위해 최신 세대 Blackwell 및 H200 가속기로 하드웨어 카탈로그를 확장했습니다.
OpenMetal은 v5 하드웨어 카탈로그 확장을 발표했습니다. NVIDIA RTX PRO 6000 Blackwell Server Edition을 기반으로 한 RP6000과 NVIDIA H200 NVL을 기반으로 한 H200이라는 두 개의 새로운 프라이빗 GPU 서버 라인을 추가했습니다. 두 서버 모두 OpenMetal의 Intel Xeon 6000 시리즈와 DDR5-6400 v5 플랫폼에서 실행되며, AI, 머신러닝, 고성능 컴퓨팅 워크로드에 전용 단일 테넌트 GPU 가속을 제공합니다. OpenMetal의 CTO인 Jamie Tischart는 "v5를 통해 베어메탈 및 프라이빗 클라우드 카탈로그의 기초를 현대화했습니다. RP6000과 H200을 추가하는 것이 자연스러운 다음 단계였습니다. AI와 HPC 워크로드를 실행하는 고객들은 현대적인 Xeon 6000 플랫폼에서 완전히 전용된 GPU를 얻을 수 있으며, 투명한 월별 청구와 실제로 제어할 수 있는 인프라를 갖춥니다. 다른 사람의 클러스터에서 제한되고 계량된 슬라이스가 아닙니다."라고 말했습니다.
각 시스템은 듀얼 Intel Xeon 6530P 프로세서와 표준 1TB의 DDR5-6400 메모리를 제공하며, 2TB로 확장 가능하고 PCIe 5.0 연결성, NVMe 스토리지 옵션, 40Gbps 프라이빗 네트워킹을 포함합니다. 이 아키텍처는 GPU 서버의 CPU, 메모리, I/O 서브시스템이 v5 라인업의 나머지와 일치하도록 보장하며, 별도의 볼트온 액셀러레이터 계층으로 기능하지 않습니다.
RP6000은 서버당 하나 또는 두 개의 NVIDIA RTX PRO 6000 Blackwell Server Edition GPU를 지원합니다. 각 GPU는 96GB의 GDDR7 메모리, 1.79 TB/s의 메모리 대역폭, 24,064 CUDA 코어를 제공합니다. 이 플랫폼은 높은 VRAM 용량과 유리한 GB당 비용으로 이점을 얻는 추론 제공, 파인튜닝, 렌더링, 혼합 AI 및 시각화 파이프라인을 위해 설계되었습니다.
H200은 서버당 하나 또는 두 개의 NVIDIA H200 NVL PCIe GPU를 지원합니다. 각 GPU는 141GB의 HBM3e 메모리와 4.8 TB/s의 메모리 대역폭을 제공하여 대규모 모델 학습 및 메모리 바운드 추론 워크로드에 적합합니다. 모든 H200 서버는 5년간의 NVIDIA AI Enterprise 소프트웨어 구독을 포함하며, 팀들이 자신의 전용 환경에서 AI를 배포하기 위한 지원되는 프로덕션급 스택을 제공합니다.
두 GPU 서버 라인 모두 고객의 워크로드와 하드웨어 사이에 공유 하이퍼바이저가 없는 단일 테넌트 베어메탈 인프라로 제공됩니다. 고객은 PyTorch, TensorFlow, JAX, Hugging Face Transformers를 포함한 일반적인 AI 및 ML 프레임워크를 실행할 수 있으며, OpenMetal의 프라이빗 네트워크를 통해 서버를 독립적으로 또는 멀티노드 GPU 클러스터의 일부로 배포할 수 있습니다. RP6000과 H200은 현재 OpenMetal의 US East 데이터 센터인 Ashburn, Virginia에서 사용 가능하며, 추가 위치가 계획 중이고, 워크로드를 커밋하기 전에 검증하고 싶어 하는 팀들을 위한 개념 증명 배포가 제공됩니다.