NVIDIA扩展超级计算基础设施以支持基于Arm的处理器架构。
英伟达公司宣布,其CUDA-X AI和HPC库、GPU加速的AI框架以及软件开发工具将在年底前支持基于Arm的机器。该公司表示,基于Arm的超级计算机应能实现更大规模的应用,这得益于其更高的能效。英伟达首席执行官黄仁勋表示:"随着传统计算扩展的结束,功耗将成为所有超级计算机的限制因素。英伟达的CUDA加速计算与Arm的高能效CPU架构相结合,将为HPC社区带来向百亿亿次浮点运算发展的推动力。"百亿亿次是指每秒能执行十亿亿次运算的计算机。
英伟达加速计算总经理兼副总裁伊恩·巴克表示,支持Arm CPU的决定源于业界广泛且不断增长的兴趣。巴克说:"Arm之所以有趣,是因为它非常开放。它提供了连接CPU和GPU以及进行更节能计算的新方式的灵活性。"英伟达的基础设施已被应用于全球最节能的25大超级计算机中的22台,支持x86和基于POWER的芯片。增加Arm支持旨在扩大英伟达在HPC领域的存在,以支持更多先进的AI工作负载。
英伟达推出了DGX SuperPOD,被称为全球第22快的超级计算机,并同步推出了一套参考架构,供希望在自身或外部数据中心部署该系统的公司使用。该系统旨在为部署大规模自动驾驶汽车队队提供AI训练基础设施,仅用三周时间就完成构建,由96台英伟达DGX-2H超级计算机组成,这些计算机通过英伟达今年早些时候收购Mellanox公司所获的新型数据中心互联技术进行集成。
DGX SuperPOD可提供9.4 petaflops的性能(即每秒千万亿次浮点运算),旨在训练自动驾驶汽车的神经网络,使其理解"道路规则"。这种性能水平可将流行的图像分类算法ResNet-50的训练时间从25天缩短至不到两分钟。英伟达AI基础设施副总裁克莱门特·法拉贝特表示:"AI领导力需要计算基础设施的领导力。很少有AI挑战像训练自动驾驶汽车那样苛刻,这需要重新训练神经网络数万次以满足极端的准确度需求。"