Nebius AI Cloud发布平台更新,提供具有增强容量管理工具的Blackwell GPU基础设施。
Nebius宣布推出Nebius AI Cloud 3.1,为其全栈AI云平台引入NVIDIA Blackwell Ultra计算能力和增强的运营功能。此版本以Nebius AI Cloud"Aether"为基础,解决客户在生产环境中扩展AI时面临的关键运营优先事项,包括跨地区GPU容量的实时可见性、多团队环境中的透明资源分配,以及随着模型复杂性提高而获得下一代计算能力。
Nebius正在全球部署NVIDIA Blackwell Ultra基础设施,NVIDIA GB300 NVL72系统和NVIDIA HGX B300系统已被客户使用。Nebius现已成为欧洲首个在生产环境中运行这两个平台的云服务商。此外,Nebius AI Cloud是全球首家在800 Gbps NVIDIA Quantum-X800 InfiniBand互连上运行生产级GB300 NVL72系统的提供商,该互连为分布式工作负载的吞吐量翻倍。该基础设施配有硬件加速网络和增强存储缓存,旨在消除基础设施瓶颈,并进一步获得MLPerf Training v5.1基准测试的领先成绩支持。
为了满足企业对运营透明度的需求,3.1版本推出了Capacity Blocks和实时Capacity Dashboard,为客户提供对所有数据中心区域内保留GPU容量和可用性的完整可见性。该版本还包括项目级配额和新的生命周期对象存储规则,对资源分配和成本提供更精细的控制。
Nebius AI Cloud平台生态系统继续扩展,包括与Dstack的原生集成和NVIDIA BioNeMo NIM微服务的简化部署,涵盖Boltz2、Evo-2、GenMol和MolMIM,无需NGC密钥或NVIDIA AI Enterprise许可证。其他开发者专注的功能包括通过Manager Soperator进行增强的基于Slurm的编排、符合FOCUS的计费导出和各种控制台用户体验改进。
最新版本在Aether企业级安全基础之上进行构建,包括用于HIPAA合规性的对象存储数据平面审计日志、按对象访问控制和VPC安全组。增强的IAM功能与Microsoft Entra ID集成以及细粒度的服务角色提供了更强的治理和简化的管理,支持高度监管行业和政府客户的合规要求。Nebius将于1月29日举办技术演练网络研讨会,时间为中欧时间下午6点、美国东部时间上午9点和太平洋标准时间中午,包括实时问答环节。