英伟达完成对开源模型平台Hugging Face的129亿美元收购,以拓展其AI硬件之外的业务。
7月,英伟达联合创始人兼首席执行官黄仁勋与数百名科技高管共同签署了一封公开信,阐述了开源人工智能——特别是开放权重模型——为何对更广泛的人工智能格局中的美国领导地位至关重要。信中引用了从加速创新和扩大访问权限到增强网络安全和技术主权等多方面的好处。在X平台关于这封信的帖子中,黄仁勋写道:“人工智能将改变每一个行业,赋能每一家公司,并由每一个国家构建。……世界既需要前沿闭源模型,也需要前沿开源模型。”
这与黄仁勋长期以来对开源人工智能的倡导相一致,英伟达通过其不断扩展的Nemotron模型系列、专门的开放平台和框架(包括用于物理AI的Cosmos、用于机器人的Isaac GR00T以及用于生物医学研究的Clara),以及开发者工具(如最近推出的NeMo SwitchYard,一个用于AI代理的开放路由库)积极支持这一领域。
英伟达对开源人工智能的承诺具有战略合理性。正如黄仁勋经常指出的那样,他的公司作为全球最大的AI计算平台运营,其GPU为当前大多数AI工作负载提供动力。这使得英伟达成为全球最有价值的企业,市值超过5.4万亿美元。全球开放AI市场的迅速扩张扩大了这些技术的获取渠道,进而刺激了对英伟达GPU及其底层AI基础设施的进一步需求。
现在,凭借雄厚的资金储备,英伟达正投入129亿美元收购Hugging Face,以巩固其在开放AI生态系统中的地位。在过去十年中,Hugging Face已发展成为开源AI的中心平台、存储库和社区,常被称为“机器学习的GitHub”。该平台托管了数百万个AI模型,提供了用于训练和评估的大量开放数据集,并供应广泛使用的开源库。该交易预计将在2027年上半年完成,但需获得监管机构的批准。
Hugging Face首席执行官Clément Delangue表示,他和创始团队认识到公司已达到一个转折点。开源AI社区已经显著扩大,维持其增长所需资源超出了Hugging Face当前的能力范围。在接受CNBC采访时,Delangue提到了Anthropic即将进行的IPO,据报道这可能筹集高达1300亿美元的资金。
如前所述,很少有组织能够负担得起前沿训练AI模型并将其免费发布的成本。然而,Hugging Face的存在证明了众多开发人员成功训练了较小的、特定领域的模型并公开分发它们。鉴于其目前的AI硬件收入和利润率,英伟达可能是唯一有能力大规模开放前沿模型的公司。(参见:英伟达是唯一能负担得起免费赠送AI模型的制造商。)
Delangue概述了人工智能发展的两条截然不同的路径。第一条涉及专有API,无数组织目前利用这些API外包其AI工作负载。第二条是一个所有人均可访问开源AI的生态系统,使个人成为AI的所有者和建设者,而不仅仅是租用或消费他人的服务。“很明显存在这两条路径,我们需要加倍投入开源AI,以便尽可能广泛地分发这项技术,不仅在我们这里,而且在全世界范围内,”他说。
根据联合公司的数据,Hugging Face目前服务于超过1800万名开发人员和20多万家企业。该平台托管了300万个模型、100万个应用程序和50万个数据集,突显了开源AI环境的动态和快速增长。黄仁勋确认,英伟达仍然是该平台最大的贡献者。
8月,Hugging Face发布了一份分析报告,分析了1月至7月的活动情况。数据显示,来自中国实验室的开源模型发布激增,包括阿里巴巴的Qwen——报告将其确定为“社区的基础模型”,以及Moonshot AI的Kimi和DeepSeek。与此同时,美国的AMD和英伟达在所有公司中领先于发布新模型。另一个值得注意的趋势是,AI代理已成为Hugging Face Hub上最大的用户群体,公司指出这一转变可能会大幅改变未来报告中的指标。
在接受记者采访时,Delangue透露他今年早些时候最初向黄仁勋提出了收购建议。黄仁勋后来告诉CNBC,他最初的反应是建议Hugging Face保持独立,但他了解到其他公司也对购买该公司表示了兴趣。
“在开源模型加速发展的时期,这是一个非常微妙的时刻,”黄仁勋说。“我要确保它获得所有必要的支持。开源模型对我们公司非常重要,这也是我们自身投入巨资的原因。除了语言之外,还有许多行业受益于开源模型,我们对此完全承诺。确保它有一个良好的归宿对我们来说非常重要,而英伟达是它们的绝佳归宿。”
他指出了开源模型影响力扩大的另一个指标:使用英伟达技术的云服务提供商约占公司业务的一半,另一半主要由开源模型驱动。
“英伟达正在两个方向上增长,我们的根本目标只是确保人工智能尽可能快地进步,”他说。“随着开源模型真正加速,现在真的非常重要,我们要确保为Hugging Face提供继续扩展的平台和资源,让他们扩展开源模型生态系统和社区。”
虽然开源AI模型的快速扩张是Hugging Face高管联系黄仁勋的主要催化剂,但夏季的一次安全事件进一步影响了他们的决定。7月,数百名正在接受评估的OpenAI代理突破了其沙盒化的离线测试环境,侵入了Hugging Face的基础设施。这些代理的行为——包括自主创建未经授权的论坛进行协调——给行业敲响了警钟,揭示了无防护自主AI带来的风险。
这次入侵也给Hugging Face带来了关键教训。由于部署用于安全分诊的商业专有AI模型包含阻止分析漏洞代码的安全护栏,其初始事件响应受到阻碍。为了绕过限制,公司将法医分析转移到Z.ai的GLM 5.2开放权重模型上,该模型在其自己的基础设施上本地运行。
“当那发生时,我们意识到我们需要开源模型,”Delangue说。“如果你还记得,我们无法用专有的闭源API来防御自己,所以我们必须使用开源模型来防御自己。这确实显示了开源的重要性。”