Nebius推出AI Cloud 3.1,搭载下一代NVIDIA Blackwell Ultra芯片,并提供透明的云端容量管理。
Nebius于2025年12月17日宣布推出Nebius AI Cloud 3.1,为其全栈AI云平台带来下一代NVIDIA Blackwell Ultra计算和增强的运营功能。版本3.1建立在Nebius AI Cloud"Aether"的基础之上,增加了透明的容量管理和扩展基础设施,为客户提供他们在生产环境中扩展AI所需的运营可见性和资源规划功能。随着客户从实验阶段转向大规模采用,他们明确了运营优先事项,包括实时了解跨地区的GPU容量、为多团队环境提供透明的资源分配,以及在模型复杂性增加时获得下一代计算资源。
Nebius正在全球部署NVIDIA Blackwell Ultra基础设施,NVIDIA GB300 NVL72系统和NVIDIA HGX B300系统已被客户使用。Nebius现已成为欧洲首个在生产环境中运营两个平台的云服务商。Nebius AI Cloud也是全球首个在800 Gbps NVIDIA Quantum-X800 InfiniBand互连上运行生产GB300 NVL72系统的提供商——为分布式工作负载的吞吐量翻倍。这一功能与硬件加速网络和增强的存储缓存相结合,消除了基础设施瓶颈,与MLPerf Training v5.1基准测试的领先成果相辅相成。
为满足企业对运营透明度的需求,版本3.1引入了容量块和实时容量仪表板,让客户能够完全了解其在所有数据中心地区的保留GPU容量和可用性。项目级配额和新的生命周期对象存储规则提供了对资源分配和成本的细粒度控制。平台生态系统继续扩展,包括与Dstack的新原生集成以及NVIDIA BioNeMo NIM微服务的简化部署,涵盖Boltz2、Evo-2、GenMol和MolMIM,无需NGC密钥或NVIDIA AI Enterprise许可证。
其他功能包括基于Slurm的增强型编排(采用Manager Soperator)、符合FOCUS标准的计费导出以及各种控制台用户体验改进。最新版本建立在Aether的企业级安全基础之上,具备用于HIPAA合规的对象存储数据平面审计日志、单对象访问控制和VPC安全组。增强的身份和访问管理与Microsoft Entra ID集成以及细粒度的服务角色提供了更强大的治理功能和简化的管理,推进了合规功能的发展,使高度受监管行业和政府部门的客户能够部署生产AI工作负载。Nebius将于1月29日欧洲中部时间下午6点/美国东部标准时间中午/太平洋标准时间上午9点举办Nebius AI Cloud 3.1技术讲解网络研讨会,包含现场问答环节。