2026年9月11日星期五
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

NVIDIA Nemotron等开放模型为企业提供完全控制定制AI业务需求

英伟达官方——路线图/产品的第一手确认。
官方披露Slicast · 2026年7月30日 · 美国 · 来源: NVIDIA Blog

业有许多强大的模型可选择,但真正的考验是他们构建的AI是否独特地满足其业务需求:改进工作流程、挖掘领域知识并超越准确性和信任标准。竞争性AI优势越来越多地来自组织如何利用可用模型进行构建,而不是他们选择哪一个。

NVIDIA Nemotron等开放模型是为定制化而构建的,帮助企业构建可控、可信且针对其特定需求的AI。专业AI应用和自主代理是通过使用在专有知识上调优并根据实际业务成果进行评估的定制化开放模型构建的。这需要能够访问模型本身。闭源模型继续推进通用智能能力的发展,但对企业能够检查、调优和改进的内容设定了上限。开放模型消除了这一障碍,并提供了完整的所有权和控制权。

最有效的代理型AI应用是模型系统,其中开放模型与领先的前沿模型并行工作,各自完成其最擅长的工作。高性能推理模型可以处理复杂的规划,而较小的模型则执行专业任务。这种方法让企业能够优化推理成本、改进特定任务的准确性,并在工作流演变时保持灵活性。

开放模型为企业提供了闭源模型无法提供的东西:完全控制来定制、检查和改进针对业务需求的AI。公共基准测试衡量通用能力,但针对业务的评估让团队能够根据其自己的数据、工作流和准确性定义进行测试,然后进一步改进。在医疗保健和法律等行业中,错误答案的代价特别高,这些行业的团队处理敏感数据并面临严格的准确性要求。这些行业中的组织必须了解模型如何被训练以及它如何执行,并具有在必要时改进它的能力。使用开放模型,团队可以检查其应用程序、针对自己的标准运行私密评估,并建立针对其自己的工作流优化的强化学习环境,而无需通过第三方路由专有数据。

各行业的公司已经在为其领域专业化Nemotron。定制化改进了准确性,当模型针对特定领域进行调优时,它们也能更高效地运行。NVIDIA NeMo开放库套件加速了模型定制和评估、代理优化和治理。Prime Intellect和Unsloth等合作伙伴正在为在Nemotron上构建后训练管道的企业提供AI定制,使在规模上运行专业AI变得切实可行。

LangChain通过调整提示、工具和中间件为Nemotron 3 Ultra调优了其Deep Agents工具,无需重新训练模型,并在开放模型中实现了最高的代理准确性,每次运行的成本比领先的闭源替代方案低约10倍。Arcee AI通过在NVIDIA Blackwell平台上对Nemotron进行后训练,实现了每百万输出令牌大约90美分的推理成本,比可比的闭源前沿模型便宜约20倍,同时在PinchBench上排名第二,并保持完全开放权重。

成本节省使更广泛的实验、更多部署和更快的迭代成为可能。从AI采用到AI所有权的转变正在进行。NVIDIA Nemotron联盟正在帮助将开放模型开发转变为一项生态系统工作,汇集模型构建者和开发人员,通过共享数据、评估和领域专业知识来改进Nemotron。黑客马拉松提交和社区贡献在各行业生成可重用的证明资产。构建者正在将Nemotron添加到其AI系统中,证明价值并分享有效的方法。基础完全是开放的。

阅读原文