2026年10月5日星期一
AI 基础设施 · 新闻与分析
首页 › 数据中心 › 报道
数据中心 · 报道

英伟达CEO黄仁勋赞扬埃隆·马斯克在19天内完成xAI的Colossus数据中心设施建设,建设速度异常快。

Colossus的加速时间表表明新的建设和部署方法可以压缩传统数据中心的建设周期,可能重塑行业资本支出步调。
行业媒体Slicast · 2026年10月3日 UTC 22:37 · 美国 · 来源: ababnews.com
重要度 70

NVIDIA首席执行官黄仁勋在BG2播客中表示,埃隆·马斯克用19天完成了通常需要一年才能完成的工作,他称其为非凡的成就。这一成就涉及xAI在孟菲斯建造的Colossus训练集群。

黄仁勋概述了传统超级计算机部署时间表:三年规划,随后一年用于安装、上电和调试,然后才能进行首次训练运行。他将其与xAI的压缩时间表进行了对比,后者从初始概念到液冷设施批准、设备上电、NVIDIA集成和首次训练,全部在19天内完成。黄仁勋表示,这样的速度只有在马斯克的领导下才有可能实现。

Colossus集群由100,000个NVIDIA H100 GPU组成,黄仁勋认为这是当时单集群配置中最快的超级计算机。他赞扬了xAI的工程、软件、网络和基础设施团队,同时指出这些人员在19天的冲刺期间可能没有休息。NVIDIA提供了网络端支持,因为其设备需要比标准数据中心服务器更复杂的安装工序。

多条时间线需要澄清。马斯克告诉乔丹·彼得森,从硬件安装到开始训练的间隔花费了19天,代表了已知最快的部署。在另一份声明中,马斯克引用122天作为从上线到成功运行的时间线。19天的数字并未涵盖从土地收购到训练启动的完整周期。

xAI成立于2023年,在Colossus建设之前已经发布了Grok-2。黄仁勋将非凡的执行速度归功于不是芯片规格,而是马斯克对工程、建筑、大型系统管理和资源调度的深刻理解。

速度优势来自于许可证、电力基础设施、液冷系统和芯片分配的并行动员——这是一种现在决定市场地位的能力。传统云供应商遵循三年规划和一年调试周期运营。能够立即为系统供电的模型公司和芯片供应商获得训练优势,而常规安排的数据中心项目面临结构性滞后。这一转变将定价权从设计机构和年度资本配置转移到能够同时协调许可证、电力、冷却和芯片交付的组织。

至关重要的是,19天的数字从硬件到达现场后开始计算,而不是从土地收购开始。122天的时间线代表从系统上电到成功训练的时期。NVIDIA在网络集成中的角色表明,速度既取决于买方执行能力,也取决于供应商整合能力。供应控制现在决定了竞赛:谁先给芯片供电,谁就先进行训练。三年周期的项目之所以仍然缺乏资金,不是因为需求不足,而是因为产品周期延迟。如果电力和许可证限制了下一个集群,标准时间线将重新发挥作用。如果这种速度证明可复制,模型公司将按上电日期而不是公告日期排名。

阅读原文
英伟达CEO黄仁勋赞扬埃隆·马斯克在19天内完成xAI的Colossus数据中心设施建设,建设… · Slicast