NVIDIA推出Vera新CPU类,专为agent AI工作负载设计,可持续性能提升1.8倍
英伟达推出了Vera,这是一种为代理AI时代构建的新型CPU。该公司将大规模单线程性能最大化定位为AI代理的关键需求,因为AI代理在持续循环中运行,每一步都依赖于前面的结果。虽然传统数据中心CPU已向更高核心数和更低成本发展,但它们牺牲了单核心速度。Vera扭转了这一趋势,优化了全部88个核心的单核性能,没有瓶颈限制。
Vera的核心是Olympus,英伟达定制的CPU核心,指令吞吐量比NVIDIA Grace高50%。该CPU将这些高速核心与最高1.2TB/s的LPDDR5X内存带宽配对,仅消耗不到40瓦的内存功耗。最关键的是,其单片计算芯片提供3.4TB/s的核心间带宽,是任何其他数据中心CPU的三倍,使所有核心都能在无降速状态下获得完整的内存性能。
在代表代理执行的满载CPU工作负载中,Vera提供了x86 1.8倍的可持续单核性能。Perplexity在真实代理工作上测试了Vera,包括存储库克隆和沙箱中的测试套件执行,发现Vera完成任务的速度比x86快约1.5倍,启动并发沙箱的速度快达1.9倍。Perplexity计划在其即将推出的生产系统中部署Vera。
除了工具执行外,Vera还加速了代理常见的数据工作负载。合作伙伴测得与领先的x86服务器CPU相比,Starburst大规模SQL分析快3倍,Redpanda实时流处理延迟降低达6倍。Vera充当整个AI工厂的统一架构,为NVIDIA Vera Rubin GPU系统和BlueField-4 STX存储处理器在同一平台和工具链上供电。
英伟达下一代采用Rigel核心的Rosa CPU将继续这一路线图。Rigel在保持相同硅占用面积的同时提供比Olympus更高的单核性能,并在指令传递、L2缓存容量和内存处理效率方面有所改进。该公司将Vera定位为基础性技术,适应未来数十亿代理将依赖CPU进行执行、验证和数据检索的时代,从而最大化GPU在收入生成工作中的利用率。