IBM和Together AI宣布$240百万合作部署首个大规模NVIDIA HGX B300
IBM和Together AI宣布建立战略合作伙伴关系,在IBM Cloud上提供AI基础设施。根据为期多年的2.4亿美元协议,IBM将部署一个大规模的NVIDIA HGX B300系统集群,预计于2027年第一季度推出。Together AI将使用该集群为企业提供开源模型推理功能。这是IBM Cloud上首个为HGX B300系统和NVIDIA Spectrum-X以太网进行推理而构建的专用大规模集群。根据NVIDIA的说法,该部署旨在提供比前几代高出30倍的AI工厂输出。
该合作旨在使Together AI能够为扩展AI部署的企业提供更好的性能和token成本效益。Together AI基于开源模型对AI未来至关重要的理念运营,最近完成了8亿美元的C轮融资,估值达到83亿美元。该平台涵盖推理、训练、微调和代理工作流程的功能。Together AI报告其目前每月服务400万亿个tokens。公司选择IBM和NVIDIA是因为他们创新的产品路线图和以所需速度提供GPU容量、提供最低token成本的能力。
Together AI首席执行官Vipul Ved Prakash表示,企业希望获得前沿模型的性能而不承受闭源模型的高价格,这需要大规模快速、可靠的基础设施。他指出,该集群为更多企业提供了生产级推理,代表了使开源AI成为企业显而易见选择的重要一步。
IBM Cloud总经理Alan Peacock强调,企业正在竞相大规模采用代理AI,IBM和NVIDIA正在提供可扩展、经济高效、企业级的AI基础设施来支持这一转变。NVIDIA高性能计算和AI基础设施解决方案高级总监Dion Harris将AI工厂描述为成为与电力和电信相媲美的必要企业基础设施,以所需的规模和性能与效率将计算和数据转化为智能。
这一合作建立在IBM和NVIDIA更广泛的合作伙伴关系基础之上,该合作伙伴关系最近在GPU原生数据分析、非结构化数据提取、本地和云基础设施以及旨在帮助组织大规模操作AI的咨询服务方面宣布了进展。