2026年9月15日星期二
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

Intel Arc Pro B60在MLPerf v5.1中实现比NVIDIA好4倍的性价比。

Intel GPU重新进入市场创造成本有效替代,压低NVIDIA定价,使云运营商多元化采购。
行业媒体Slicast · 2025年9月9日 UTC 12:00 · 全球 · 来源: wccftech.com
重要度 65

特尔通过MLCommons最新的MLPerf Inference v5.1发布了其Project Battlematrix工作站的新基准测试,该工作站采用英特尔Arc Pro B60 GPU。测试结果展示了采用英特尔Xeon P核心和英特尔Arc Pro B60显卡的英特尔GPU系统在6个关键基准测试中的性能。在Llama 8B推理工作负载中,英特尔Arc Pro B60相比NVIDIA RTX Pro 6000提供高达1.25倍的性能/成本优势,相比L40S高达4倍的优势。

更具体地说,在Llama 3.1(8B数据中心)推理工作负载中,英特尔Arc Pro B60"Project Battlematrix"解决方案在离线模式下生成6472.37 Samples/s,查询速率为5348.45 Queries/s,而NVIDIA L40S分别为1642.22 samples/s和1207.14 Queries/s。虽然RTX PRO 6000"Blackwell" GPU总体上性能更快,但英特尔声称其解决方案的性能/成本提高了25%,解决了限制高性能推理平台采用的成本因素。

至今为止,寻求能够提供高推理性能同时保持数据隐私并避免与专有AI模型相关的高额订阅成本的平台的专业人士面临选择有限。英特尔的Project Battlematrix旨在填补这一空白,提供一个集成了经过验证的硬件和软件的一体化推理平台,以满足大型语言模型现代AI推理部署的需求。

该系统包括针对Linux环境构建的容器化解决方案,针对多GPU扩展和PCIe P2P数据传输进行了优化,并具有企业级可靠性和可管理性功能,如ECC、SRIOV、遥测和远程固件更新。CPU在这些系统中发挥关键的协调作用,处理预处理、传输和整体系统协调。英特尔Xeon通过过去四年来在基于CPU的AI性能中的持续改进,已确立自己为GPU驱动系统中托管和管理AI工作负载的首选CPU。

英特尔仍然是唯一向MLPerf提交服务器CPU结果的供应商,突显了其在计算和加速器架构中加速AI推理能力的承诺。英特尔Xeon 6 P核心在MLPerf Inference v5.1中实现了1.9倍的代际性能改进,进一步证明了该公司在基于CPU的AI推理中的领导地位。

阅读原文
Intel Arc Pro B60在MLPerf v5.1中实现比NVIDIA好4倍的性价比。 · Slicast