2026年9月19日星期六
AI 基础设施 · 新闻与分析
评论员 · 触发: 尽管推理令牌成本下降了1000倍,但由于应用量增长,AI基础设施总拥有成本反而上升;分析涉及Gr

SambaNova对比Groq与Cerebras:令牌成本下降1000倍背景下的推理架构竞争,2026年9月

SambaNova完成10亿美元F轮融资,估值达110亿美元——距上轮巨额融资仅五个月——三家推理芯片公司正面临单位令牌成本骤降千倍、而AI基础设施总支出持续攀升的市场悖论。

SambaNova于2026年9月完成10亿美元F轮首次交割,估值达110亿美元——距上一轮巨额融资仅五个月。这一时间节点,恰好对应AI推理行业一个微妙的拐点:推理令牌价格近年来骤降约千倍,然而企业AI基础设施支出非但未随之收缩,反而因应用量持续扩张而攀升,效率红利被不断涌现的新需求消化殆尽。对于SambaNova、Groq和Cerebras而言,这一动态将原本小众的定制芯片赌注,转化为战略价值显著提升的筹码——在一个无论单位经济效益如何变化、整体规模仍持续扩大的基础设施市场中,三家公司均赢得了一席之地。

此轮融资的战略内涵不亚于其规模本身。摩根大通被列为推理合作伙伴,意味着至少一家大型金融机构正将AI部署从租用GPU转向定制芯片供应商,用于生产环境工作负载。与此同时,SambaNova于2026年8月宣布任命Mohsen Moazami为全球战略与合作副主席,明确以加速企业及主权AI部署为目标。英特尔方面,则经历了从据报道的收购谈判——最早于2025年10月见诸报道——到谈判破裂后签署多年期AI推理协议的转变,清晰说明主流厂商选择与SambaNova合作,而非将其差异化架构并入麾下。

SambaNova的技术论点围绕”内存墙”展开。大型模型推理在计算层面受内存带宽瓶颈制约:关键在于如何在各级存储之间高效移动模型权重,而非单纯提升算力。据Jon Peddie Research 2026年7月至9月发布的分析,SambaNova基于可重配置数据流单元构建的专有数据流架构——有别于传统GPU着色器阵列——专为突破上述瓶颈而设计。同一研究还指出,若该优化路径如宣称的那样可扩展,超大规模推理工作负载所需的资本支出或将大幅降低。2026年7月的一项基准测试将SambaNova平台与NVIDIA H200结合部署,在MiniMax推理任务中实现每秒763个令牌,被援引为异构计算架构具备实际可行性的佐证。

该公司的估值跃升速度令人瞩目,也招来审视。据2026年6月报道,SambaNova估值约在四个月内暴涨五倍,达到100亿美元,随后9月融资进一步提升至110亿美元。这一加速折射出推理芯片领域真实存在的竞争迫切性:Groq于2026年6月完成6.5亿美元融资,累计融资额达7.5亿美元,当前估值69亿美元;分析人士已将SambaNova与Cerebras相提并论,视其为定制芯片推理赛道潜在的下一个突围者。三家公司均在争夺当前由NVIDIA H100和H200平台主导的市场细分,也都在阐述同一个核心主张——在推理层,专用芯片最终将在性能/成本比上超越通用GPU计算。

2026年9月的分析以”推理悖论”为框架,将上述投资逻辑呈现得更为清晰:当令牌价格降低千倍,企业的支出并不会随之减少千倍——它们会构建千倍体量的应用。由于需求弹性远超早期预期,基础设施总成本反而上升。对SambaNova及同业而言,这是一股结构性顺风:更低单价的架构不会侵蚀市场,只会将其扩大。但风险同样来自这枚硬币的另一面——若推理经济效益持续压缩,推理即服务提供商的利润率将承受严峻压力,定制芯片的商业逻辑有赖于在性能/美元指标上相对NVIDIA持续迭代的通用硬件保持持久优势。

展望后市,三个信号将检验SambaNova的命题能否成立:摩根大通的推理合作是否能从参考客户深化为可披露的长期承诺;Moazami任命所指向的海外企业及主权AI市场开拓能否取得实质进展;以及SambaNova与NVIDIA异构架构的基准测试结果能否从实验室转化为规模化客户部署。本轮融资为首次交割,后续或有更多资金跟进。据2026年6月报道,Groq已被整合入NVIDIA Vera Rubin平台——这表明推理芯片竞赛的结局或许并非取代NVIDIA,而是被其收编。这使得SambaNova与最大名义竞争对手之间的竞争定位,成为其下一轮融资周期必须正视的核心问题之一。

基于 18 篇历史报道 · SambaNova
SambaNova对比Groq与Cerebras:令牌成本下降1000倍背景下的推理架构竞争,2026年9月 · Slicast