Crusoe与Thinking Machines Lab合作,利用Crusoe托管推理平台大规模运行开源模型推理工作负载。
Crusoe 和 Thinking Machines Lab 今天宣布达成 6500 万美元年度协议,将在 Crusoe Cloud 上为该实验室的开放模型提供推理服务。通过 Crusoe Managed Inference,Thinking Machines Lab 将在一个专用定制部署上提供一系列生产工作负载——包括其 Inkling 模型、GLM 5.2 和 5.3 以及其自有微调变体——该部署采用由 NVIDIA Quantum-2 InfiniBand 网络连接的 NVIDIA HGX B200 系统,工程设计用于大规模高吞吐量、成本高效的推理服务。
Thinking Machines Lab 的机器学习基础设施负责人 Myle Ott 表示:"Crusoe Managed Inference 让我们快速从评估过渡到生产环境,满足了我们对自有系统的标准要求,为我们提供了规模和经济效益,使我们能够重新投资于我们工作核心的研究。"
Crusoe Cloud 产品管理高级副总裁 Erwan Menard 表示:"Thinking Machines Lab 拥有一支非常精尖的工程团队,在他们成长过程中期望合作伙伴达到很高的标准。我们由顶尖 AI 工程师组成的团队打造了 Crusoe Managed Inference,旨在以服务形式提供成本高效、可靠的基础设施、推理以及模型生命周期工具,使创新企业能够在我们的专业支持下,在生产环境中大规模运行他们选择的模型。"
Crusoe 将作为定制部署直接运营和支持该集群——一个专用的、经过基准测试、受 SLA 保障的端点——为 Thinking Machines Lab 提供性价比和扩展空间,无需自行管理推理堆栈。两家公司还在探索向批量推理扩展,用于大规模合成数据生成,将推理转变为研究的飞轮。
Thinking Machines Lab 加入了一个不断增长的客户名单,他们已将 Crusoe Managed Inference 的合同年度经常性收入推升至超过 1 亿美元,而该服务从推出至今不到一年。