AMD公布其RTX Spark AI加速器的基准测试成绩,定位为英伟达数据中心AI计算产品的竞争对手。
AMD公布了其新款Gorgon Halo Ryzen AI Max+ Pro 495 CPU的AI性能成果,强调了这款处理器独特的192GB内存容量——比单一Nvidia RTX Spark或AMD Strix Halo芯片多50%。根据AMD的说法,这个内存优势使得配备该CPU的机器能够运行参数量达3000亿的AI模型。
这一公告的发布时机精心策划,恰好在Nvidia于10月7日的微软活动上推出RTX Spark AI芯片前几天。Ryzen AI Max+ Pro 400系列在很大程度上是对前代Strix Halo Ryzen AI Max+ Pro 300系列的更新,具有增强的RAM寻址能力和高出100MHz的时钟速度,将其定位为AMD对RTX Spark的直接竞争产品。
由于RTX Spark尚未展示其全部性能,AMD转而与英特尔酷睿超级X9 388H进行基准测试——鉴于该英特尔芯片面向消费市场的定位及其64GB最大内存上限,这个对比在某种程度上并不公平。
AMD声称其Ryzen AI Max+ Pro 495在AI性能上比英特尔处理器快1.1倍至32.2倍。该公司报告在GLM 5.3 Flash上达到每秒20个令牌(这是一个参数量为3200亿的开源权重模型,被认为是目前最好的模型之一,尽管每个令牌只有180亿参数处于活跃状态),并在Qwen 3.8 Flash上达到每秒42个令牌(这是一个参数量为1250亿的模型,每个令牌有50亿个活跃参数)。
除了支持更大的模型外,充足的内存容量使得能够同时运行多个模型——例如,部署一个小型快速模型处理常规任务,同时在后台保留一个更大的模型用于处理复杂查询。
虽然192GB内存池相比RTX Spark的128GB存在优势,但内存本身并不决定AI性能。计算速度和内存带宽同样至关重要。更高的GPU计算性能(FLOPS/TOPS)使得AI系统能够更快地处理更大的提示词,减少生成响应前的延迟。它还通过减少渲染时间来加速图像生成。然而,一旦文本生成开始,速度就会受到内存带宽的制约。
Ryzen AI Max+ Pro 495将其内存优势与适度的带宽改进相结合:273GB/s,相比Strix Halo的256GB/s提升了6.5%。在其他方面,该处理器基本上与其前代产品Ryzen AI Max+ Pro 395相同,配备16个Zen 5 CPU核心和40个RDNA 3.5 GPU计算单元,CPU和GPU时钟频率均提升了100MHz。
Gorgon Halo的优势在于处理大型AI模型的能力,AMD声称支持参数量高达3000亿的模型。这是否会在RTX Spark上产生优势仍不确定。据Tom's Hardware报道,上一代Strix Halo在使用4比特量化的GPT-OSS 120B上实现了每秒56个令牌,而Nvidia的DGX Spark达到了每秒64个令牌。考虑到DGX Spark与即将推出的RTX Spark具有相似的架构,新的Gorgon Halo在某些AI任务上可能难以匹敌Nvidia的性能。
配备Gorgon Halo的系统,如Minisforum MS-S1 Max-P495,将以7,399美元的价格推出。虽然价格不菲,但这反映了其强大的板载内存。对于便携选项,AMD合作伙伴将推出配备Ryzen AI Max+ Pro 400的笔记本电脑,包括售价7,449美元的HP ZBook Ultra G3a。