Intel Arc Pro B60在MLPerf v5.1中实现比NVIDIA好4倍的性价比。
英特尔通过MLCommons最新的MLPerf Inference v5.1发布了其Project Battlematrix工作站的新基准测试,该工作站采用英特尔Arc Pro B60 GPU。测试结果展示了采用英特尔Xeon P核心和英特尔Arc Pro B60显卡的英特尔GPU系统在6个关键基准测试中的性能。在Llama 8B推理工作负载中,英特尔Arc Pro B60相比NVIDIA RTX Pro 6000提供高达1.25倍的性能/成本优势,相比L40S高达4倍的优势。
更具体地说,在Llama 3.1(8B数据中心)推理工作负载中,英特尔Arc Pro B60"Project Battlematrix"解决方案在离线模式下生成6472.37 Samples/s,查询速率为5348.45 Queries/s,而NVIDIA L40S分别为1642.22 samples/s和1207.14 Queries/s。虽然RTX PRO 6000"Blackwell" GPU总体上性能更快,但英特尔声称其解决方案的性能/成本提高了25%,解决了限制高性能推理平台采用的成本因素。
至今为止,寻求能够提供高推理性能同时保持数据隐私并避免与专有AI模型相关的高额订阅成本的平台的专业人士面临选择有限。英特尔的Project Battlematrix旨在填补这一空白,提供一个集成了经过验证的硬件和软件的一体化推理平台,以满足大型语言模型现代AI推理部署的需求。
该系统包括针对Linux环境构建的容器化解决方案,针对多GPU扩展和PCIe P2P数据传输进行了优化,并具有企业级可靠性和可管理性功能,如ECC、SRIOV、遥测和远程固件更新。CPU在这些系统中发挥关键的协调作用,处理预处理、传输和整体系统协调。英特尔Xeon通过过去四年来在基于CPU的AI性能中的持续改进,已确立自己为GPU驱动系统中托管和管理AI工作负载的首选CPU。
英特尔仍然是唯一向MLPerf提交服务器CPU结果的供应商,突显了其在计算和加速器架构中加速AI推理能力的承诺。英特尔Xeon 6 P核心在MLPerf Inference v5.1中实现了1.9倍的代际性能改进,进一步证明了该公司在基于CPU的AI推理中的领导地位。