2026年9月11日星期五
AI 基础设施 · 新闻与分析
深度分析2026-07-22
每周分析 ·

GPU 云成为超大规模云计算企业的公用事业

纵向整合和超大规模云计算企业间的租赁正在将第三方 GPU 供应商逐出战略重要地位。

超大规模云计算企业已停止争夺 GPU 容量,转而开始自建。本月仅 Meta、OpenAI、Anthropic 和 Google 就宣布了超过 500 亿美元的自有基础设施投资:Meta 的路易斯安那州超大型数据中心、OpenAI 的 200-300 亿美元乔治亚州园区、Anthropic 的 190 亿美元 TeraWulf 合同,以及 Meta 与 Anthropic 之间的 100 亿美元超大规模云计算企业间租赁协议。与此同时,来自 MGX、AIP 和贝莱德等机构的 400 亿美元资本完成了对 Aligned Data Centers 的收购,日本也宣布了与 NVIDIA 合作的主权人工智能基础设施联盟。这一趋势不言而喻:超大规模云计算企业和政府正在巩固对人工智能基础设施的控制权。第三方 GPU 供应商不再是平台——它们正在成为公用事业。

新云计算市场对此做出了正确定价。CoreWeave、Nebius 和 IREN 本月市值分别下跌 30-61%,投资者认识到了结构性问题:当超大规模云计算企业控制自己的供应链时,第三方供应商就会失去杠杆作用。NVIDIA 对 Nebius 的 9.3% 股份投资(股价上涨 19%)不是表示信心,而是应急措施——这家芯片巨头押注至少有一家独立分销商能够存活。Hut 8 和 TeraWulf 已通过与超大规模云计算企业签订长期固定合同进行调整,而不是作为通用云提供商竞争。CoreWeave 的 2,490 亿美元债务负担现在处于系统性审查之下。GPU 供应多元化(AMD 与 Anthropic 的 50 亿美元合作伙伴关系、NVIDIA 的 Vera 芯片生产)验证了芯片替代品的可行性,但多元化只有在第三方供应商仍能竞争时才具有意义。

效率正在侵蚀资本支出护城河。SpaceX AI 的吉瓦级设施声称在推理工作负载上实现 280 亿美元的年化收入——相比传统云计算溢价 3-5 倍——通过为更狭隘的使用场景优化软件和硬件。更重要的是:据报道,Moonshot AI 的 Kimi K3 与 Anthropic 的 Opus 4.8 相匹配,由一支 300 人的团队在美国出口管制下开发。如果软件效率、精简团队和开源权重模型关闭性能差距的速度比超大规模云计算企业部署 200-300 亿美元超大型数据中心更快,那么竞争就不再是关于原始 GPU 积累。而是关于每个 GPU 的智能密度和对分发层的控制。

需要关注的三个信号:(1) 新云计算 M&A——困难资产甩卖确认了结构性衰退;战略溢价表明超大规模云计算企业将容量视为补充性资产。(2) AMD 在 Anthropic 的实际训练工作负载份额——若 >25%,多元化是真实的;若 <10%,则属于虚张声势。(3) 棕地可扩展性——TeraWulf 的 190 亿美元 Anthropic 交易证明改造后的化石燃料电厂可以提供快速资本支出。如果再有五份这样的合同以每份 150-250 亿美元的价格达成,自有基础设施 + 长期合同 + 固定电力将成为资本支出的标准,取代未来十年的云租赁模式。

GPU 云成为超大规模云计算企业的公用事业 · Slicast