Equinix联合英伟达与Together AI在其企业托管设施内部署优化的AI推理机柜。
Equinix Inference Exchange 结合了 NVIDIA 企业参考架构、Together AI 的推理平台以及 Equinix 的全球基础设施,旨在优化部署速度、灵活性和成本效益。全球数字基础设施公司 Equinix 宣布,将其与 NVIDIA 长期以来的合作关系进一步扩展,推出面向全球企业的分布式 AI 推理解决方案 Equinix Inference Exchange,并与 Together AI 建立新的合作伙伴关系。
随着 AI 在模型、提供商和地理区域层面的规模化扩展,推理的位置已成为决定性能、成本和治理的战略要务。Equinix Inference Exchange 将为企业提供更快速的路径,从 AI 实验过渡到生产环境,提供安全、低延迟的连接,以访问其依赖的数据、用户和生态系统。
此次合作将 NVIDIA 经过验证的企业参考架构与 Together AI 的推理平台相结合,后者支持超过 200 种开源模型。该解决方案通过 Equinix 的全球数据中心交付,并通过 Equinix Fabric 实现与云、网络和 AI 提供商的无缝连接。
“AI 正在以非凡的速度改变企业技术,而企业今天所做的基础设施决策将在未来几年内定义其竞争地位。凭借近三十年来构建值得信赖的交换平台的经验——全球企业在此运行、连接并编排其最关键的工作负载——Equinix 处于独特的位置,能够满足这一时刻的需求。”Equinix 首席执行官兼总裁 Adaire Fox-Martin 表示。“我们与 NVIDIA 的长期合作关系提供了现代 AI 核心的加速计算基础,而 Together AI 对开放生态系统的承诺赋予企业按自身条件扩展的灵活性。Equinix Inference Exchange 将启用在设计上中立、默认开放且为卓越性能而工程化的架构。”
NVIDIA 全球 AI 云及基础设施生态系统副总裁 Raj Mirpuri 表示:“Equinix Inference Exchange 将全球领先的数字互连平台转变为 AI 推理的全球网络。随着加速计算成为一种战略资产类别,将 NVIDIA 的基础设施与技术、Together AI 的开源模型推理平台以及 Equinix 的全球覆盖范围相结合,为企业提供了一个强大的分布式基础,使智能更贴近其数据、应用程序和客户——从而加速下一代智能服务的发展。”
Together AI 联合创始人兼首席执行官 Vipul Ved Prakash 表示:“Together AI 建立在一种信念之上:开放、可访问的 AI 将是定义行业未来的关键,因为企业不应在模型性能和运营灵活性之间做出选择。我们与 Equinix 和 NVIDIA 的合作证明了模型选择和性能并非权衡取舍,而是正确实施企业 AI 的基础。”
**推理运行位置至关重要**
企业采用 AI 的步伐正超出支持其所需的基础设施速度。随着企业 AI 从实验转向生产,推理越来越需要在靠近用户、数据和应用程序的地方运行,跨越云、模型、提供商和地理区域。这一转变要求组织不仅要确定如何部署 AI 基础设施,还要确定其应在何处运行以及如何连接到所依赖的数据、应用程序和工作负载。管理这些分布式的推理部署引入了显著的运营复杂性,而这恰恰是企业需要更大控制和可见性的时刻。
The Futurum Group AI 平台副总裁兼业务主管 Nick Patience 表示:“随着 AI 工作负载在提供商、数据源和环境中的分布日益广泛,性能、成本和治理已成为战略考量因素。组织越来越关注推理运行的位置以及其进入生产环境的部署速度。能够简化推理部署同时保持灵活性的解决方案,对于实现业务成果变得越来越重要。”
Equinix 为此挑战带来了无与伦比的规模和生态系统密度,在全球 77 个大都市区运营着超过 280 个数据中心、230 个云接入点,并在其中性交换平台上连接了超过 10,500 家企业。前 10 大 AI 模型提供商中有 8 家,前 10 大 AI 云服务提供商中有 9 家均部署在 Equinix,凸显了该公司在 AI 生态系统中的核心地位。
**专为选择与灵活性而建**
Together AI 是 Equinix 庞大 AI 生态系统的最新成员,为大规模部署 AI 的企业提供开源模型的灵活性和选择权。该解决方案整合了三个互补层,旨在简化分布式 AI 推理:
* Equinix 提供基础设施基础,包括电力、先进冷却和 Day-two(日常)运营,并通过 Equinix Fabric 连接到推理所依赖的云、网络和 AI 提供商。
* NVIDIA 以其企业参考架构和专为最大化 AI 工厂吞吐量及最小化令牌成本而设计的 AI 基础设施锚定架构。
* Together AI 运营平台层,支持用于共享效率的多租户部署,以及为需要隔离容量的工作负载提供的专用单租户环境。
基于 Equinix Fabric 构建,该解决方案将连接全球主要大都市区的推理提供商,显著缩短首个令牌的生成时间。它还链接到庞大的云、网络和 AI 提供商生态系统,简化了部署复杂性。
**专为现代企业推理设计**
该解决方案旨在支持广泛的企业推理场景:
**大都市边缘推理**使组织能够在靠近最终用户和数据源的地方运行推理,利用 Equinix 的安全性、运营规模和全球覆盖范围,提供更低延迟的 AI 体验。
**开源模型迁移**为从封闭专有模型向开源替代方案过渡的企业提供了一条直接、低摩擦的生产路径。组织可以在 Together AI 的开源模型平台上运行迁移,该平台可通过与其他提供商相同的互连网络访问,从而控制成本并避免供应商锁定。
**主权 AI**通过在满足数据驻留和主权要求的地点运行工作负载,支持受监管行业或特定地理区域的企业。这提供了一种简化的 AI 扩展路径,同时严格控制在何处处理数据和推理。
Equinix Inference Exchange 将于 2027 年第一季度开始提供。
**其他资源**
Token Optimization Begins with Choice [分析师报告]
The Coordination Economy: How Enterprises Really Build AI Value [博客]
Equinix Inference Exchange [产品页面]
Equinix Inference Exchange Product Release Note [产品发布说明]
Equinix Horizon Event Page [活动页面]