NVIDIA推出新收益分享模式,为AI云服务商提供大规模推理基础设施
随着AI从模型开发转向生产推理,计算需求在加速并转向持续运营的AI工厂,这些工厂能够大规模生成token。这种转变需要获得大规模、多租户加速计算,这些计算能够快速上线、保持高利用率并支撑token规模AI服务的经济性。
新兴AI公司历来对资本密集型基础设施的获取渠道有限,即使长期承诺也不足以为计算获得融资。为了解决这个问题,NVIDIA推出了一种新的商业模式,向快速增长的AI生态系统——包括初创公司、模型构建者、企业、研究机构和地区AI参与者——开放计算获取权限。
这种新模式使AI云能够通过收益分享和信用支持模式的经济协调,为AI原生、企业和ISV客户采购NVIDIA基础设施。通过此合作伙伴关系,AI云将销售NVIDIA驱动的云服务,NVIDIA既获得标准产品收入,也获得支持容量的云收入分成。这种结构加速了NVIDIA平台在高增长、高确定性AI原生部门的采用,并为NVIDIA提供了一个循环的、使用关联的收入流。
对于模型构建者、推理提供商、代理平台和规模化AI的企业,这可能意味着更快地获得全栈加速计算,而无需等待站点选择、电力采购、建设和硬件投入。
Sharon AI和Firmus是首批与NVIDIA合作这一新商业模式的公司。Sharon AI正在部署最多40,000个NVIDIA Grace Blackwell GB300 GPU。Sharon AI联合创始人兼首席执行官James Manning表示,此战略合作标志着Sharon AI在提供主权、大规模AI计算基础设施使命中的关键时刻。
Firmus正在印度尼西亚巴淡岛建设一个DSX AI工厂园区,预计规模将扩大至360兆瓦和最多170,000个NVIDIA GPU。Firmus Technologies联合首席执行官Tim Rosenfield指出,AI原生公司需要获得可扩展、能源和成本高效的计算基础设施才能进行全球竞争,Firmus AI云正在建设与NVIDIA DSX对齐的AI工厂,以帮助客户获得构建和扩展AI所需的计算资源。
Baseten、Fireworks AI和Together AI等AI原生公司展示了计算需求的发展方向。他们需要立即获得AI云容量,以运行模型训练、后训练、微调和为开发人员、数字原住民和构建AI的企业提供的大规模代理推理。他们的客户需要随着使用增加而可靠地获得大规模NVIDIA加速计算,但当产品从试点转向生产时,他们也需要商业灵活性。