IBM与Together AI达成2.4亿美元多年协议,在IBM Cloud上部署大规模NVIDIA HGX B300推理集群,用于受监管企业AI工作负载。
IBM和Together AI签署了一份为期多年、金额为2.4亿美元的协议,将在IBM Cloud上部署大规模NVIDIA HGX B300系统集群,基础设施预计于2027年第一季度推出。这将是IBM Cloud上首个采用NVIDIA HGX B300系统和NVIDIA Spectrum-X以太网交换的大规模专用推理集群。该基础设施将帮助Together AI提高推理容量,同时降低向企业客户提供AI模型服务的成本。
Together AI将使用该集群为开源AI模型提供推理服务。Together AI首席执行官Vipul Ved Prakash表示:"企业希望获得最前沿模型的性能,同时避免付出闭源模型的代价,而这只有在底层基础设施足够快速和可靠的情况下才能实现。与IBM和NVIDIA携手合作为我们奠定了坚实的基础。这个集群让我们能够更快地为更多公司提供生产级推理服务,这是我们推动开源AI成为企业明显选择的重大一步。"
Together AI的推理业务目前每月处理400万亿个令牌。该公司最近以83亿美元的估值完成了8亿美元的C轮融资,融资将用于其AI Native Cloud平台。该平台涵盖推理、模型训练、微调和代理工作流,将开源模型定位为闭源AI系统的替代方案。
Together AI选择IBM和NVIDIA基于其基础设施路线图以及以所需扩展速度提供GPU的能力。令牌服务成本也是决策的关键考虑因素。
该集群将使用通过NVIDIA Spectrum-X以太网交换连接的NVIDIA HGX B300系统。NVIDIA的B300平台相比前一代产品可提供30倍的AI工厂输出。
IBM认为该基础设施通过将Together AI的推理平台与IBM Cloud基础设施相结合,为其开辟了进入企业市场的道路。IBM Cloud总经理Alan Peacock表示:"企业正在争先采纳大规模的代理AI以推动真实的业务成果。IBM和NVIDIA正在提供可扩展、经济高效的企业级AI基础设施,这将帮助Together AI加快下一代AI基础设施的创新步伐。"
这笔交易扩展了IBM和NVIDIA在GPU原生数据分析、非结构化数据提取、本地和云基础设施以及咨询服务等领域的现有合作。
NVIDIA高性能计算和AI基础设施解决方案高级总监Dion Harris强调了该基础设施在企业部署中的作用。Harris表示:"AI工厂正在成为重要的企业基础设施,就像电力和电信一样,将计算和数据转化为智能。"