芯片与硬件 · 报道
高通推出Dragonfly AI加速器机架系统,瞄准英伟达、AMD和华为客户。
将高通定位为第三方AI推理替代品,分散GPU加速器市场。
行业媒体Slicast · 2026年6月30日 UTC 18:25 · 美国 · 来源: TechRadar
重要度 55高通正大举进入AI数据中心市场,推出其Dragonfly加速器系列,针对推理工作负载,并将自己定位为HBM架构的替代方案,该架构由英伟达和AMD主导。该公司在2026年投资者日活动上公布了其战略,旨在在面临内存短缺问题的市场中实现差异化。
Dragonfly平台利用高通自有的低功耗双倍数据速率(LPDDR)内存,采用3D架构堆叠在其AI加速器上方,而不是依赖高带宽内存。即将推出的Dragonfly AI200每个机架提供43 TB的LPDDR5X容量和414 TB/s的内存带宽,每张加速器卡配备768 GB的LPDDR5X。不过,重点将主要放在Dragonfly AI250上,该产品集成了高通专有的高带宽计算(HBC)技术。
虽然AI250保持与AI200相同的每机架43 TB内存容量,但其HBC实现支持高达7.4 PB/秒的内存带宽——理论上是AI200的0.4 PB/秒的18倍。这种巨大的带宽优势使Dragonfly对于以推理为中心的部署具有吸引力,在这类部署中数据吞吐量至关重要。
高通的方法与英伟达和AMD等竞争对手明显不同,后者继续为其旗舰加速器(特别是用于训练任务的加速器)依赖HBM。然而,高通以推理为中心的架构似乎引起了超大规模云服务商的共鸣——Meta和Microsoft的兴趣表明,该公司有着可行的发展道路,因为数据中心将重点转向大规模部署日益复杂的模型用于推理。该公司将Dragonfly定位为多项计划发布中的第一个,以寻求在利润丰厚的数据中心领域建立有意义的立足点。