2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

华为展示AI超级计算机,完全不含美国组件,证明国产芯片生态系统的成熟度。

中国AI计算堆栈国产化减弱了美国出口管制的杠杆作用,为中国市场AI应用奠定了英伟达的竞争对手。
行业媒体Slicast · 2026年7月21日 · 美国 · 来源: WION
重要度 75

上海世界人工智能大会上——习近平在这次大会上首次发表WAIC主题演讲,并启动了中国新的全球人工智能治理机构——华为推出了其认为是对英伟达的回应。首次公开展示的Atlas 950 SuperPoD是中国最大的人工智能计算系统。其最重要的规格不是性能基准,而是系统内部没有任何美国产品。

展厅展示的配置连接了1024个华为昇腾AI芯片跨越16个机柜——这只是完整系统的一部分,华为表示完整系统将8192个昇腾950DT处理器链接为单一计算节点。该公司声称完整的SuperPoD提供的计算能力是英伟达NVL144系统的6.7倍。

根据华为公布的数据,该系统在FP8精度下可实现每秒100亿亿次浮点运算,在FP4精度下达到200亿亿次,并拥有256TB的全局可寻址内存。这些数字是华为自己的声明,尚未获得独立验证——这一警告同样适用于任何厂商在任何国家展会上的所有声明。

该系统的重要意义更多在于架构而非原始规模。这些芯片通过华为专有的UnifiedBus 2.0协议连接,其作用是充当内存结构而非网络:系统中的每个芯片都将其他每个芯片的内存映射到自己的本地地址空间。实际上,8192个处理器的表现更像一台巨大的机器,而不是计算机集群。

华为表示上限要高得多:多个SuperPoD可以链接成Atlas 950 SuperCluster,规模可达50万个昇腾芯片以上——这种配置如果实现,将跻身有史以来全球组装的最大人工智能计算系统之列。

这正是美国出口管制设计要阻止的机器。美国规则禁止英伟达最先进的处理器进入中国;任何Blackwell级芯片向中国实体的转让都需获得许可证,美国官员本月表示即使是较旧的H200芯片也只有"微不足道"的数量获得批准许可后进口。华为的回应是一个完整的本土堆栈——芯片、互连、机柜、软件——分析人士将其称为中国迄今为止最成熟的示范,证明前沿人工智能基础设施可以在完全没有美国产品的情况下构建、训练和部署。

坦诚的说法是,单个昇腾芯片仍被广泛认为落后于英伟达最先进的硅片。华为的策略是通过规模和架构来弥补——只要连接足够多的本土芯片并足够巧妙地架构,即使单个芯片不如对手,系统仍可竞争。这种权衡在实际训练工作负载中是否可行,是现在每个人工智能实验室和情报机构都在思考的问题。

Atlas 950的首次亮相为期间一周的中国人工智能力量展示画上了句号。世界人工智能大会举办了140多个分论坛,超过1100家参展商和约300款新产品发布。习近平亲自启动了WAICO,这是一个由29个创始国组成的新政府间人工智能治理组织,总部设在上海。在软件方面,月之暗面AI的Kimi K3——迄今最大的开源权重大模型——在全球主要编程排行榜上名列前茅,其完整权重将在7月27日向全球开放。

硬件、模型,再到规则框架:北京用短短一周时间展示了对美国人工智能秩序的完整堆栈替代方案。

多年来,华盛顿一直在问出口管制是否能阻止中国人工智能的崛起。上海的答案就摆在展厅的地板上,在16个机柜中运行,嗡嗡作响。

阅读原文