英伟达、英特尔和AMD在2024年计算机展上推出了主要的AI芯片和基础设施技术。
在2024年台湾Computex大会上,Nvidia、Intel和AMD发布了重要公告,表明半导体行业正进入加速发展的新时代。Nvidia首席执行官黄仁勋公布了为未来数据中心提供的新GPU、CPU和其他芯片的扩展路线图。AMD首席执行官苏姿丰公布了扩展的数据中心加速芯片路线图,将于今年晚些时候推出288GB的Instinct MI325X GPU,同时还计划发布用于AI笔记本电脑的Ryzen AI 300芯片、Ryzen 9000台式机系列,以及192核EPYC "Turin"处理器。Intel首席执行官Pat Gelsinger公布了新的Xeon 6 E核心CPU、即将推出的用于AI PC的Lunar Lake处理器,并透露了Intel即将推出的Gaudi 3 AI芯片的生态势头和平台定价。Nvidia还公布了其Blackwell GPU模块化设计MGX的扩展、推出NIM推理微服务,以及为运行其RTX GPU的PC增强AI应用开发的计划。
Nvidia制定了激进的战略,计划每年发布新的数据中心GPU架构,这代表着从之前两年发布周期的加速。黄仁勋阐述了该公司的理念:"我们的基本理念非常简单:构建整个数据中心规模,将其分解,按一年的节奏以零件形式出售给你,我们将一切都推向技术极限。"这一路线图跟随Nvidia三月份发布的Blackwell架构,与2022年的Hopper架构相比,它能实现高达30倍的推理性能提升,并降低25倍的大规模AI模型能耗。2025年,Nvidia计划发布Blackwell Ultra,黄仁勋将其描述为"推向极限",同时还会发布更新的Spectrum Ultra X800以太网交换机。2026年,该公司将推出Rubin,这是一个采用HBM4内存的全新GPU架构,同时还将推出名为Vera的第二代CPU(继其基于Arm的Grace架构之后),NVLink 6交换机将芯片间带宽增加一倍至3600 GBps,CX9 SuperNIC能达到1600 GBps,以及X1600代InfiniBand和以太网交换机。黄仁勋强调:"我向你们展示的所有这些芯片都在完全开发中,100%的芯片,节奏是一年一次,在技术极限处,全部100%架构兼容。"
通过其MGX模块化参考设计平台,Nvidia使服务器制造商能够"快速且经济高效地构建100多种系统设计配置",通过选择他们偏好的GPU、CPU和数据处理单元组合。新公布的GB200 NVL2单节点服务器设计包含两个Blackwell GPU和两个Grace CPU,可集成到现有数据中心中。MGX平台支持其他Blackwell产品,包括B100 GPU、B200 GPU、GB200 Grace Blackwell超级芯片和GB200 NVL72,还将支持Intel即将推出的Xeon 6 P核处理器和AMD即将推出的EPYC "Turin"处理器,两家公司都计划"首次"推出"各自的CPU主机处理器模块设计"。AMD公布了其使用新Zen 5架构的下一代Ryzen 9000台式机处理器,旗舰16核Ryzen 9 9950X将于7月开始出货。