2026年9月30日星期三
AI 基础设施 · 新闻与分析
首页 › 数据中心 › 报道
数据中心 · 报道

ScaleMatrix与NVIDIA推出无需传统数据中心的分布式AI/HPC设备。

模块化自包含AI系统降低部署难度,实现与超大规模数据中心互补的分布式计算模式。
行业媒体Slicast · 2019年11月19日 UTC 12:00 · 全球 · 来源: datacenterknowledge.com
重要度 65

在丹佛超级计算机大会SC19上,数据中心提供商ScaleMatrix推出了AI Anywhere产品,这些设备可提供高达13 petaFLOPS的性能,配备内置冷却系统,只需"屋顶、地板空间和电源插座"就能启动"一个企业级数据中心,能够支持重要的人工智能或高性能计算工作负载",ScaleMatrix联合创始人兼首席执行官Chris Orlando表示。该产品解决了一个关键障碍:大多数用于机器学习和AI工作负载的高性能计算系统无法在典型数据中心内运行而无需进行重大设施改造,因为GPU密集型HPC系统使机架功率密度达到约30kW/机架,是一般数据中心3kW至5kW/机架平均负载的至少五倍。

AI Anywhere是通过ScaleMatrix、芯片制造商Nvidia和计算机集群及HPC和AI服务器供应商Microway之间的三方合作开发的。该解决方案以两个单机架版本提供,各采用Nvidia的DGX超级计算机型号之一。一个型号包含13个DGX-1单元,提供13 petaFLOPS的性能,而另一个型号包含4个DGX-2系统,提供8 petaFLOPS的性能。两个单元都遵循DGX-POD参考架构设计,并包含完整的NVIDIA DGX软件堆栈、深度学习和AI框架容器、NetApp ONTAP存储和Mellanox交换机。

这些即插即用超级计算机的创新在于ScaleMatrix专有的闭循环冷却水辅助强制风冷系统。DGX-1版本功耗为42kW,DGX-2版本功耗为43kW,该设备采用混合空气-水冷方式,利用机架内传感器将冷气输送到需要的地方。正如Orlando解释的那样:"冷却水进出和进行热交换的区域与机柜其余部分隔离,这样我们就能获得水冷的所有优势,而不会引入任何风险。"该设计可处理更高的密度——ScaleMatrix子公司DDC最近推出了一个能够处理高达85kW的机架,采用相同的冷却系统。

根据Nvidia AI和深度学习产品营销总监Tony Paikeday的说法,AI Anywhere解决了持久存在的客户需求。"客户正在部署越来越大的基础设施,以应对更复杂的AI问题,如自然语言处理,或者他们正在进行整合,试图将分散在企业各处的'影子AI'等零散AI平台投资集中到一个屋顶下,"他说。关键障碍一直是许多企业不愿在数据中心基础设施中进一步投入资本支出。"因此,这现在是消除最后一公里障碍的完美方式,让客户能够获得这类计算能力,"Paikeday指出。这些设备将以AI Anywhere品牌进行市场推广,与Nvidia、NetApp、Mellanox、Microway和DDC等组件合作伙伴各自在各自的基础设施元素上保留自有品牌。

阅读原文
ScaleMatrix与NVIDIA推出无需传统数据中心的分布式AI/HPC设备。 · Slicast