Meta正在其基础设施中大规模部署Nvidia独立CPU。
Meta已成为最早大规模部署英伟达独立Grace CPU的超大规模计算公司之一,根据周二发布的公告。该公司已在仅CPU系统中部署了这些Grace处理器,并正在与英伟达合作从明年开始部署即将推出的Vera CPU。这一扩展是基于Meta之前在其Andromeda推荐系统中部署英伟达Grace-Hopper超级芯片的基础。Meta现在计划在其基础设施中部署"数百万"个英伟达GB300和Vera Rubin超级芯片。
这一转变标志着与英伟达典型部署模式的重大偏离。除了少数科研机构外,英伟达已有近三年历史的Grace CPU主要以"超级芯片"的形式出货,该芯片集成了Hopper和Blackwell GPU。Meta现在使用英伟达仅CPU的Grace系统来支持不需要GPU的通用和智能体AI工作负载。根据英伟达超大规模和HPC副总裁兼总经理Ian Buck的说法,"Grace是一款出色的后端数据中心CPU。它在后端工作负载上实际上可以提供2倍的性能功耗比。"Grace CPU配备72个Arm Neoverse V2核心,时钟频率高达3.35 GHz,可单独配置提供高达480 GB内存,或作为Grace-CPU超级芯片,将两个处理器与高达960 GB LPDDR5x内存和两个芯片之间高达1 TB的内存带宽相结合。
英伟达的Vera CPU于今年早些时候在CES上正式推出,代表了一次重大升级,具有88个定制Arm核心、同步多线程支持和保密计算功能。Meta将利用Vera的保密计算功能为其WhatsApp加密消息服务的私密处理和AI功能提供支持。Meta采用英伟达CPU与更广泛的行业趋势相反,行业越来越多地转向亚马逊的Graviton或谷歌的Axion等定制Arm CPU。
这一扩大的合作反映了Meta在基础设施方面的巨大投资,该超大规模计算公司除了部署CPU外,还在部署额外的英伟达GPU和Spectrum-X网络基础设施。这与Meta 2026年1150亿至1350亿美元的资本支出目标相一致。虽然英伟达对该合作的规模保持沉默,但该公司预计将从这笔交易中获得数百亿美元的收入。每机架超过350万美元,一百万个GPU将代表约480亿美元——即使对于在截至10月26日的季度中实现319亿美元净收入和570亿美元营收的英伟达来说,这也是一笔巨大的数字。
尽管与英伟达有深入的合作关系,Meta并不是英伟达的独家客户。该公司在其数据中心中维护着规模庞大的AMD Instinct GPU集群,并直接参与了AMD Helios机架系统的设计,该系统将于今年晚些时候推出。广泛预期Meta将部署AMD的竞争性机架系统,尽管尚未做出正式承诺。