2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

AMD和Cerebras合作开发超低延迟、分解式AI推理平台,结合Helios EPYC和Cerebras晶圆规模引擎。

推理专用化现为生产可行:晶圆规模架构成为成本/延迟关键型工作负载替代品,加速市场碎片化。
行业媒体Slicast · 2026年7月24日 · 美国 · 来源: Technetbook
重要度 82

AMD和Cerebras Systems建立了一项技术合作伙伴关系,以构建一个分布式人工智能推理系统,解决先进软件中的速度瓶颈问题。该联合平台整合了AMD Helios机架级基础设施与Cerebras晶圆级引擎,计划在今年下半年在Cerebras云上推出。

现代AI工作负载根据任务不同有不同的计算需求。简单的文本生成需要大量数据容量,而实时代理和编码助手则需要即时反馈。该合作伙伴关系通过在两个专门芯片之间分配工作来优化两者:AMD Helios处理初始提示处理和大型数据上下文,而Cerebras晶圆级引擎管理生成单个单词这一内存密集型任务。这种合作分工预计将提供5倍更高的效率,以每瓦特秒tokens数来衡量。

在Advancing AI大会期间,AMD首席执行官Lisa Su强调了行业对更加灵活的计算架构的需求。Cerebras首席执行官Andrew Feldman同样强调了市场对更快处理能力的迫切需求。

文本生成的速度在软件开发、机器人技术和科学研究中已成为关键因素,迟缓的响应时间会降低用户体验。为了支持该产品推出,Cerebras将在自有数据中心内安装Helios硬件,并作为云选项提供该组合服务。这一方法让开发人员能够获得高吞吐量处理,而不牺牲系统响应性,使企业能够运行复杂的AI工作流,而无需承担构建自有基础设施的资本支出。

阅读原文