2026年9月30日星期三
AI 基础设施 · 新闻与分析
首页 › 算力与云 › 报道
算力与云 · 报道

General Compute选择Cerebras进行多年AI推理部署,扩展了这家推理加速器供应商的企业客户基础。

多年承诺验证了Cerebras的推理优化处理器,证明了市场对独立于通用GPU平台的专业推理硬件的持续需求。
行业媒体Slicast · 2026年9月29日 UTC 18:51 · 美国 · 来源: Pulse 2.0
重要度 75

总部位于旧金山的新云公司General Compute专业提供替代型AI加速器的融资、部署和运营服务。该公司已与Cerebras Systems达成多年协议,将大规模部署Cerebras超快速AI推理技术,初期重点是代理编码和自主软件开发工作负载。

该协议为Cerebras晶圆级计算系统开辟了新的分销渠道,使General Compute的客户能够获得专用的Cerebras推理容量,而无需购买底层硬件。General Compute将负责硬件的融资和部署,并根据标准化商业条款向客户提供相应的计算容量,客户因此无需直接管理Cerebras系统。

首个应用场景聚焦于AI编码代理,在这个领域推理速度至关重要。自主编码代理在规划、编写、测试、调试和修改软件的过程中会进行数百次甚至数千次顺序模型调用。在这类工作负载中,每个推理步骤的细微延迟会在整个任务执行过程中不断累积,最终导致完成时间大幅延长。General Compute计划通过现有基础设施平台向开发人员、企业和正在构建编码助手与自主软件代理的AI公司提供Cerebras驱动的推理服务。

Cerebras在晶圆级处理器的基础上设计了其AI系统,这种架构旨在消除将AI工作负载分布在大量传统加速器上所带来的瓶颈。General Compute的协议将这一架构延伸至新云交付模式,使客户能够以服务方式购买推理容量。

从历史来看,大型AI系统的高昂成本限制了组织大规模部署替代型加速器的能力。但随着贷款机构对差异化AI硬件融资越来越积极,这种市场格局正在改变。General Compute最近从Upper90获得了4亿美元的债务融资,为专业推理硬件的融资和部署提供了额外支撑。这种融资模式使新云提供商能够获取专业AI系统并向客户提供使用权,而推理供应商无需在自己的资产负债表上承担硬件成本。

与仅围绕GPU构建基础设施不同,General Compute正在构建一个基于针对特定AI工作负载优化的替代芯片的平台。代理编码是早期重点应用,因为延迟直接影响开发人员的生产力。自主编码代理在完成一项任务之前需要执行众多相互关联的操作,这意味着整体体验不仅取决于模型的智能程度,还取决于每次推理调用的处理速度。General Compute认为更快的令牌生成能够缩短软件开发任务的实际运行时间。

该合作伙伴关系还为Cerebras打开了新的客户群体,这些客户可能更倾向于通过云服务商购买推理能力,而不是直接管理Cerebras系统。Cerebras晶圆级推理预计将从2027年第一季度开始通过General Compute提供。

该协议出现在AI基础设施提供商日益围绕推理性能进行差异化竞争、而非单纯关注模型训练计算需求的大背景下。随着AI代理执行越来越复杂的多步骤任务,推理速度变得愈发重要,因为每次额外的模型调用都会增加整个工作流的延迟。Cerebras与General Compute的合作旨在应对这一挑战,同时展示融资和部署替代传统GPU基础设施的另一条路径。

Cerebras首席技术官兼联合创始人Sean Lie表示:"在AI领域,速度就是生产力。一个需要数百步才能完成任务的代理的速度最终取决于其最慢的步骤。与General Compute的合作将Cerebras的速度优势呈现在这些代理的开发者面前,通过他们已经信任的平台。"

General Compute联合创始人兼首席执行官Finn Puklowski补充说:"我们创立General Compute的目标是将最快的推理芯片应用于最需要它的工作负载。代理编码是最明显的例子。代理会进行数千次顺序调用,延迟会不断累积,影响实际运行时间。Cerebras提供速度优势,我们的客户将其提供给开发者,这项协议证明了新云可以大规模融资和部署这类硬件。"

阅读原文
General… · Slicast