Nvidia宣布新的Nemotron模型和NeMo路由器软件,推进开源AI部署并减少对闭源生态的依赖。
英伟达正通过技术扩展和战略合作伙伴关系继续扩大其在AI生态系统中的影响力。该公司正在扩展其开源AI模型组合,并推出一个开源模型库,帮助组织为代理AI工作流的每一步选择合适的模型——消除了默认使用单一模型或手动评估选项的需求。
在模型领域,英伟达正在扩展其Nemotron系列,推出Nemotron 3.5 Lightning,该模型设计用于作为该公司所称"模型系统"的一部分运作,即不同模型处理不同工作流步骤的模型集合。这代表了超越混合专家(MoE)方法的一层抽象。英伟达生成AI副总裁卡里·布里斯基解释道:"高效的代理需要模型系统,而不仅仅是一个模型。代理解决方案和工作流进行许多模型调用。在制定计划后,它分步骤执行,或者说我们所谓的轮次。不同的步骤需要许多不同智能水平的任务。"
英伟达在过去一年推出了三个先前的Nemotron模型。Nemotron Nano于2025年12月发布,是一个高吞吐量、高效的小语言模型,专为实时AI代理、多步工具调用、高级数学和编码设计。Nemotron 3 Super是一个1200亿参数的开源权重模型,采用MoE设计,用于高效的代理工作流、复杂推理和精准的企业工具调用。Nemotron 3 Ultra是一个拥有5500亿参数的推理模型,处理多步工作流的高吞吐量和长时间运行的代理,包括代理协调、深度仓库编码、研究和企业自动化。
Lightning综合了该系列的功能。"Lightning汇集了我们家族的精华:将Ultra的知识浓缩在Nano的体量中,"布里斯基说。"Lightning为处理持续专业任务流的常开代理而构建——是一个用于高容量AI的超级工作马模型,快速、精准且高效,在其类别中提供四倍的吞吐量,同时具有与我们Super模型相同的智能指数。"该模型可以在英伟达的Jetson、GeForce RTX、DGX Spark和DGX Station系统上运行,使开发人员能够在自己的硬件上运行操作,而不是为每项任务调用云API。
根据英伟达通过PinchBench进行的测试——该基准在编码、研究和文件管理等代理任务上对开源模型进行评分——Lightning的速度比可比的通义模型快达30%,且比Google DeepMind的Gemma等模型更快。4倍的输出速度导致完成代理AI任务的速度提升30%。组织可以通过NeMo平台在专有数据和工具上对Lightning进行后期训练。英伟达正在发布其训练数据和技术,并发布Nemotron-RL-Agentic-Terminal-Pivot,一个用于训练编码代理的开源数据集。
Lightning利用英伟达的混合Mamba transformer架构和多令牌预测技术。该模型在涉及CodeRabbit、Harvey和Lila的各种任务中表现优于其他开源和专有模型,在CrowdStrike方面也表现良好,可与Nemotron 3 Super相媲美。
与Lightning一起,英伟达发布了NeMo Switchyard路由库,使组织能够为代理工作流中的每项任务选择最优模型。布里斯基指出:"随着工作流的演进,最佳模型会改变。代理在完成任务时具有多种状态。当工具返回结果、发生错误或某些任务变成常规时,代理状态会改变。路由器持续平衡质量、延迟和成本。固定的模型选择无法适应这些变化。" AI模型路由器并非新概念——包括OpenRouter、Not Diamond和LiteLLM在内的供应商提供类似功能。微软在5月推出了Switchcraft,声称它可以提高精度近83%,并降低推理成本84%。
英伟达将Switchyard与其开源模型阵容相结合,为开发人员提供集成工作流和路由功能。"Switchyard为开发人员和平台提供了一种方式来定义他们自己的模型池、路由标准和策略,"布里斯基解释道。"它将前沿模型路由到推理密集步骤,将Lightning路由到执行任务,其中速度和效率最重要。这就是模型系统的力量——为工作流的每一步匹配合适的模型。"测试表明,Switchyard以Anthropic Opus 4.8单独成本的三分之一提供更好的精度,与Opus 4.8结合Lightning和Gemma 3时有进一步改进。
除了模型之外,英伟达还在推进AI安全。在发生涉及OpenAI GPT-5.6-Sol和其他未发布前沿模型的Hugging Face自主入侵报告后,英伟达主导开发了开放安全AI联盟——一个由三十多家公司组成的联盟,主张对AI威胁的保护必须建立在所有防御者都可以适应和部署的开源模型和工具之上。该联盟现在包括120多个成员,正在制定增强代理AI网络安全的指南。英伟达也在组建AI安全和安全团队。
为了应对AI基础设施成本,英伟达正与Apollo、贝莱德、黑石、布鲁克菲尔德、高盛和KKR合作,建立一个5000亿美元基金,支持企业、初创公司和政府的AI基础设施投资。英伟达联合创始人兼首席执行官黄仁勋表示:"在AI中,计算就是收入。我们的DSX AI工厂和广泛的开发人员、客户和采购方生态系统表明,为什么我们要汇聚世界领先的长期资本提供商来独立承销AI基础设施。"