2026年9月21日星期一
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

Intel详细介绍Ponte Vecchio GPU架构,针对HPC和AI工作负载进行优化。

表明英特尔在AI基础设施高性能GPU设计中的竞争。
行业媒体Slicast · 2022年8月23日 UTC 12:00 · 全球 · 来源: theregister.com
重要度 70

Intel在Hot Chips大会上首次较为详细地展示了其旗舰数据中心GPU,代号为Ponte Vecchio。根据其内部基准测试,该芯片性能超越AMD的MI250x,并可与Nvidia即将推出的H100 GPU相媲美。去年发布的Ponte Vecchio是Intel首次认真尝试为AI/ML和HPC应用交付高性能GPU。该芯片实际上是一系列内存和计算芯粒,使用Intel的Foveros和EMIB封装技术组合粘合成一个"堆栈",每个加速器包含两个这样的堆栈。根据Intel院士洪江(Hong Jiang)的说法,这些堆栈可以根据应用需求表现为一对GPU芯粒或单个逻辑芯粒。Intel声称Ponte Vecchio将基于允许相同峰值FP32和FP64性能的设计选择,提供52 teraflops的性能,略领先于AMD的47.9Tflop(FP64)MI250X,接近Nvidia H100的60Tflops(FP64)。Intel还讨论了其XMX矩阵加速器的性能,这类似于Nvidia的张量核心,声称GPU在单精度矩阵计算中将提供419Tflops的性能。

部分性能可归因于Ponte Vecchio的大型缓存,其中包括64MB寄存器文件、64MB L1缓存、408MB L2缓存和128GB HBM内存。洪江表示:"这真的帮助我们将数据保留在芯片上,而不必访问HBM内存。"Intel和Nvidia的GPU都依赖PCIe 5.0与主机连接,这意味着与AMD基于PCIe 4.0的MI200系列GPU的比较并不完全具有可比性。新的PCIe规范提供了两倍的主机带宽,但需要来自Intel或AMD的下一代CPU,两者目前都还未推出。虽然Nvidia可以在今年秋天AMD Epyc 4芯片推出时选择使用它们,或使用自己的Grace CPU,但Intel似乎坚持全Intel架构。Intel在HotChips展示了四个液冷Ponte Vecchio GPU与两个Sapphire Rapids Xeon Scalable处理器配对的1U机箱,尽管可以使用该公司的Xe Link fabric将最多8个GPU连接到单个节点。

Intel已将Ponte Vecchio的发布时间推迟到2023年Q1,比原定推出时间晚了一年多。与此同时,AMD计划在2023年发布其Instinct MI300加速器,将其宣传为"首款数据中心APU",采用Zen 4处理器与基于CDNA 3的GPU共封装,声称相比MI250X性能提升8倍。Nvidia在今年春季GTC大会上发布了Grace-Hopper Superchip,将其基于Arm的Grace CPU与GH100 GPU、512MB LPDDR5X和80GB HBM3内存集成在单个1000W封装中。为不落后,Intel在5月宣布了类似的Falcon Shores XPU计划,将其配备HBM的Sapphire Rapids CPU和Ponte Vecchio GPU堆栈合并到单个封装中,声称相比"当前平台"性能功耗比、内存容量和带宽提升5倍。

Ponte Vecchio不仅面临来自Nvidia和AMD的竞争,如果继续推迟发布,该芯片的产品生命周期可能会被后继产品代号为Rialto Bridge的芯片所缩短。Rialto Bridge预计将在明年开始流片,Intel将把功耗提升至每个模块800W,并需要液冷。至少有一个客户正在急切期待Ponte Vecchio的到来:美国能源部的阿贡国家实验室(Argonne National Laboratory),该实验室计划在其Aurora超级计算机中使用该芯片,尽管该项目一直受到Intel导致的延期困扰。

阅读原文
Intel详细介绍Ponte Vecchio GPU架构,针对HPC和AI工作负载进行优化。 · Slicast