惠普推出搭载AMD EPYC处理器的ProLiant Gen13服务器,针对企业级AI推理和智能体工作负载,实现CPU-GPU平衡。
HPE于10月7日发布了其首款ProLiant Gen13服务器阵容,采用AMD第六代EPYC 9006 SP7系列处理器,代号为"Venice"。这四款新系统旨在使企业能够运行AI推理、智能体AI和传统企业工作负载(包括分析和虚拟化),同时提供新的自动化安全和扩展的管理功能。
旗舰ProLiant DL585a Gen13服务器最多配备8个GPU和2个Venice处理器,针对AI推理、智能体AI、检索增强生成(RAG)模型微调和分析等要求严格的企业工作负载。该服务器将于2027年3月上市,支持来自Nvidia、AMD和Intel的GPU。HPE服务器产品管理、质量和技术追求副总裁约翰·卡特表示:"这不是那种大型Nvidia Vera Rubin NVL72或AMD Helios的横向扩展系统。这是针对企业级客户的。这是我们首次使用AMD主节点推出这种企业级AI系统。在这方面有很多出色的性能改进,充分利用了更大的内存带宽和更高性能的CPU。"
HPE还推出了三款以CPU为中心的服务器。ProLiant DL525将于2026年11月上市,是一款紧凑的1U单插槽系统,采用一个最多256核的Venice处理器,专为AI推理和传统企业工作负载(如虚拟化、欺诈检测、市场数据处理、建模和模拟)而设计。另外两款基于CPU的机架级系统将于2027年推出,针对拥有数据密集型AI或HPC工作负载的大型企业和专业云提供商:ProLiant XD245(四节点液冷系统)和ProLiant XD285(二节点风冷系统)。
根据Moor Insights & Strategy分析师马特·金博尔的说法,HPE的发布反映了该公司在满足新兴企业AI需求方面的积极定位。AMD的EPYC处理器通过其高核心数、内存容量和带宽提供了强大的AI能力。IDC研究副总裁库巴·斯托拉斯基指出,这四款新服务器为多样化的工作负载需求提供了良好的硬件组合。"每个企业都会有各种不同的AI用例。因此,从基础设施的角度来说,不能采用一刀切的方案。不能只是建立最大的、最昂贵的GPU集群,然后期望这对每个企业都是最好的解决方案。"
新的以CPU为中心的ProLiant Gen13服务器可以与GPU系统协同工作以处理智能体AI工作流,CPU为中心的服务器处理编排、工具调用和检索,而GPU管理推理。金博尔表示:"需要大量的CPU来驱动编排,因为这些智能体在进行调用,子智能体也在进行调用。这是一场持续的流量风暴,这就是AMD的Venice如此有趣的原因。那种高核心数和高单线程性能在支持智能体AI的编排方面表现出色。"
Gen13系统通过HPE Integrated Lights-Out 8提供了新的自动化安全功能,包括对自加密驱动器的支持和扩展的后量子密码学准备,HPE主流计算客户倡导和技术支持总监克里斯·布拉德利如是说。HPE Compute Ops Management软件包括低接触的入门和近实时的功率容量洞察。