2026年9月30日星期三
AI 基础设施 · 新闻与分析
首页 › 芯片与硬件 › 报道
芯片与硬件 · 报道

AMD计划在数据中心应用中实现EPYC CPU与Radeon GPU的更紧密整合

更紧密的CPU-GPU整合可提升AI工作负载效率,削弱英伟达在集成系统中的优势
行业媒体Slicast · 2019年12月19日 UTC 12:00 · 全球 · 来源: crn.com
重要度 75

根据AMD数据中心解决方案部门副总裁兼总经理斯科特·艾勒(Scott Aylor)的说法,AMD正在追求其EPYC处理器与Radeon Instinct GPU之间的更紧密集成。艾勒表示:"我认为你们将看到在时序、能力和工作负载亲和性方面越来越紧密的耦合,这我认为将成为常态。"这一集成战略涵盖多个领域,包括高性能计算、机器学习、人工智能和可视化。这一方法对AMD来说代表了一个重大战略转变,而此前的关键性一年是2019年,当时这家芯片制造商推出了其首款7纳米CPU用于桌面和服务器,并通过新的EPYC Rome处理器完成了对数据中心市场的重新进入。

此前,AMD按照不同的时间表推出新版本的EPYC和Radeon产品——Radeon Instinct MI50和MI60 GPU在2018年11月发布,而第二代EPYC Rome在2019年8月发布。该公司计划今后更紧密地同步这些发布,包括硬件和软件方面的改进,继续开发AMD的Infinity Fabric和PCIe连接技术,以及用于GPU加速计算的ROCm软件平台。艾勒解释了AMD对这一软件集成的愿景:"当你听到橡树岭的各位谈论Frontier时,他们有一个我们正在努力实现的愿景:你可以灵活地选择在CPU还是GPU上执行工作,而不是必须编写大量定制代码来分别让GPU和CPU工作。"

AMD与Cray公司为美国能源部橡树岭国家实验室共同开发的1.5艾字浮点运算超级计算机Frontier成为了这一集成战略的北极星。这台超级计算机计划于2021年投入使用,预计将成为世界上速度最快的超级计算机,将采用基于AMD Zen架构未来版本的EPYC处理器,以及新的Radeon GPU和定制的Infinity Fabric互连。艾勒表示:"你可以想象这些是如何共同架构的,以创建一个1.5艾字浮点运算的系统。你无法一步到达那个山顶。"

早期的结果证明了AMD集成方法的优势。根据NAMD 2.13基准测试结果,由两个EPYC 7742处理器和八个Radeon Instinct MI50 GPU组成的服务器配置比配有两个Intel Xeon Platinum 8280处理器、两个PCIe 3.0开关和八个Nvidia Tesla V100 GPU的服务器快26%。性能优势主要源于AMD最新处理器中的PCIe 4.0支持,这使得AMD系统在CPU与GPU通信中能够达到512 GB/s的吞吐速度,而Intel系统则为64 GB/s。AMD数据中心GPU业务副总裁兼总经理奥吉·布基奇(Ogi Brkic)指出:"这完全是为处理器提供足够数据的问题。"此外,AMD的配置消除了对PCIe开关的需求,降低了系统成本,同时降低了延迟并维持了持久的性能。

虽然AMD强调与英特尔和英伟达竞争产品的开放性和兼容性,但该公司优先考虑其所谓的"A加A"——通过AMD GPU和AMD CPU组合提供更好的集成体验。位于明尼苏达州伯恩斯维尔的HPC系统集成商Nor-Tech工程副总裁多米尼克·达宁格(Dominic Daninger)观察到,AMD的CPU-GPU集成工作解决了服务器中的吞吐量瓶颈,因为处理器的性能日益超过数据传输速度。达宁格表示:"英特尔在其GPU产品中看到了同样的问题:在更高带宽下在CPU和GPU之间传输数据的能力对双方都将很重要。"

阅读原文
AMD计划在数据中心应用中实现EPYC CPU与Radeon GPU的更紧密整合 · Slicast