2026年9月15日星期二
AI 基础设施 · 新闻与分析
首页芯片与硬件报道
芯片与硬件 · 报道

英伟达宣布NemoClaw Deep Agents蓝图配LangChain,目标通过优化框架实现AI推理成本10倍降低。

推理成本降低架构进入主流;英伟达将优化堆栈定位为对抗替代硅供应商的竞争护城河。
行业媒体Slicast · 2026年7月8日 UTC 16:13 · 美国 · 来源: Crypto Briefing
重要度 63

Nvidia和LangChain发布了适用于LangChain深度代理的NemoClaw,这是一个于7月8日宣布的开源企业AI蓝图,它结合了Nvidia的Nemotron 3 Ultra模型、LangChain的深度代理框架和Nvidia的OpenShell安全运行时。该系统实现了基准领先的性能,推理成本比最接近的竞争对手降低了10倍以上。

成本优势非常明显:Nemotron 3 Ultra与深度代理框架配合在评估中得分为0.86,每次调用成本为4.48美元,而最接近的选项则为43.48美元。在这个价位,企业可以在更广泛的工作流中部署这些代理,而不是仅将其保留用于最高价值的任务。

该蓝图集成了三个核心组件。LangChain的深度代理框架处理认知架构——规划、内存管理和子代理编排。Nemotron 3 Ultra作为基础模型;由于它是开源权重,企业可以检查和定制它,而不是依赖专有的黑盒。OpenShell提供具有安全沙箱的运行时环境,这是企业IT部门在将系统部署到生产数据附近之前所需的。该架构被设计为可定制和可调整的,使企业能够控制其专有数据、工作流和内存。

Nvidia和LangChain在整个2026年期间一直在朝这一合作伙伴关系发展,年初宣布了更广泛企业代理AI平台的初步计划,包括AI-Q蓝图和3月左右的额外集成。

Nvidia首席执行官詹森·黄对这一里程碑做出了简洁的评估:"超级代理已经到来。"LangChain首席执行官哈里森·蔡斯则采取了更细致的观点,强调围绕模型构建健壮系统的重要性,而不是简单地扩展模型本身。

全球专业服务巨头EY是参与生产部署的企业合作伙伴之一。Baseten和Fireworks AI负责处理推理服务。EY的参与表明主要咨询公司正在为客户围绕这些系统建立实践,当四大会计师事务所开始将一项技术产品化时,企业采用通常会迅速加速。

阅读原文
英伟达宣布NemoClaw Deep… · Slicast