Nebius AI Cloud Blackwell GPU 인프라 및 향상된 용량 관리 도구 플랫폼 업데이트 공개
Nebius는 NVIDIA Blackwell Ultra 컴퓨팅과 향상된 운영 기능을 풀스택 AI 클라우드 플랫폼에 제공하는 Nebius AI Cloud 3.1을 발표했습니다. 이번 릴리스는 Nebius AI Cloud "Aether"의 기반을 바탕으로, 고객이 프로덕션 환경에서 AI를 확장하면서 직면하는 주요 운영 우선순위인 지역별 GPU 가용성에 대한 실시간 가시성, 다중 팀 환경에서의 투명한 리소스 할당, 모델 복잡도 증가에 따른 차세대 컴퓨팅 접근성을 해결합니다.
Nebius는 전 세계적으로 NVIDIA Blackwell Ultra 인프라를 배포하고 있으며, 고객들은 이미 NVIDIA GB300 NVL72 시스템과 NVIDIA HGX B300 시스템을 사용하고 있습니다. Nebius는 이제 유럽에서 두 플랫폼 모두를 프로덕션 환경에서 운영하는 최초의 클라우드가 되었습니다. 또한 Nebius AI Cloud는 분산 워크로드의 처리량을 두 배로 늘리는 800 Gbps NVIDIA Quantum-X800 InfiniBand 인터커넥트 위에서 프로덕션 GB300 NVL72 시스템을 운영하는 글로벌 최초의 제공업체입니다. 이러한 인프라는 하드웨어 가속 네트워킹과 인프라 병목 현상을 제거하도록 설계된 향상된 스토리지 캐싱으로 보완되며, MLPerf Training v5.1 벤치마크에서 선도적인 결과로도 뒷받침됩니다.
기업의 운영 투명성에 대한 요구를 충족하기 위해 버전 3.1은 Capacity Blocks와 실시간 Capacity 대시보드를 도입하여 고객이 모든 데이터 센터 지역에서 예약된 GPU 용량과 가용성에 대한 완전한 가시성을 확보할 수 있도록 합니다. 이번 릴리스에는 프로젝트 수준 할당량과 리소스 할당 및 비용에 대한 세분화된 제어를 확장하는 새로운 라이프사이클 객체 스토리지 규칙도 포함되어 있습니다.
Nebius AI Cloud 플랫폼 생태계는 Dstack과의 새로운 네이티브 통합과 NGC 키나 NVIDIA AI Enterprise 라이선스 없이 Boltz2, Evo-2, GenMol, MolMIM을 포함한 NVIDIA BioNeMo NIM 마이크로서비스의 간소화된 배포를 통해 계속 확장되고 있습니다. 추가 개발자 중심 기능으로는 Manager Soperator를 통한 향상된 Slurm 기반 오케스트레이션, FOCUS 준수 청구 내보내기, 그리고 다양한 콘솔 사용자 경험 개선 사항이 포함됩니다.
최신 릴리스는 HIPAA 준수를 위한 객체 스토리지 데이터 플레인 감사 로그, 객체별 액세스 제어, VPC 보안 그룹 등 Aether의 엔터프라이즈 준비형 보안 기반을 바탕으로 구축되었습니다. Microsoft Entra ID 통합과 세분화된 서비스 역할을 갖춘 향상된 IAM 기능은 강력한 거버넌스와 간소화된 관리를 제공하며, 고규제 산업 및 정부 부문의 고객에게 필요한 규정 준수 요구사항을 지원합니다. Nebius는 1월 29일 CET 오후 6시, EST 오전 9시, PST 정오에 기술 설명 웹세미나를 진행하며 라이브 Q&A 세션이 제공됩니다.