Tuesday, September 15, 2026
AI 인프라 · 뉴스 & 분석
반도체·하드웨어리포트
반도체·하드웨어 · 리포트

Nvidia, LangChain과 함께 NemoClaw Deep Agents 청사진 발표, 최적화 프레임워크로 AI 추론 비용 10배 감소 목표

추론 비용 감소 아키텍처가 주류화되면서 Nvidia는 최적화 스택을 대체 실리콘 제공업체에 대한 경쟁 장벽으로 포지셔닝하고 있다.
업계 전문지Slicast · 2026년 7월 8일 16:13 UTC · 미국 · 출처: Crypto Briefing
중요도 63

비디아(Nvidia)와 랭체인(LangChain)은 엔비디아의 Nemotron 3 Ultra 모델, 랭체인의 Deep Agents 프레임워크, 그리고 엔비디아의 OpenShell 보안 런타임을 결합한 오픈소스 기업용 AI 설계도를 공개했다. 이 시스템은 가장 가까운 경쟁사 대비 추론 비용을 10분의 1 이하로 낮추면서도 벤치마크 최고 수준의 성능을 달성했다.

비용 우위는 뚜렷하다. Deep Agents 하니스와 결합된 Nemotron 3 Ultra는 호출당 비용이 $4.48로 평가에서 0.86점을 기록했으며, 이는 다음으로 가까운 옵션인 $43.48에 비해 현저히 낮은 수준이다. 이러한 가격대로 기업들은 고부가가치 작업에만 한정하지 않고 훨씬 더 광범위한 워크플로우에 에이전트를 배포할 수 있다.

이 설계도는 세 가지 핵심 구성 요소로 통합된다. 랭체인의 Deep Agents 프레임워크는 계획 수립, 메모리 관리, 서브 에이전트 오케스트레이션 등 인지 아키텍처를 담당한다. Nemotron 3 Ultra는 기반 모델로서 오픈 가중치를 제공하므로 기업은 독점적인 블랙박스에 의존하는 대신 모델을 직접 검사하고 사용자 정의할 수 있다. OpenShell은 엔터프라이즈 IT 부서가 프로덕션 데이터 근처에 시스템을 배포하기 전에 요구하는 안전한 샌드박싱 기능을 갖춘 런타임 환경을 제공한다. 이 아키텍처는 사용자 정의 및 튜닝이 가능하도록 설계되어 기업이 자체 데이터, 워크플로우, 메모리에 대한 통제권을 유지할 수 있게 한다.

엔비디아와 랭체인은 2026년 내내 이번 파트너십을 위해 구축해 왔으며, 올해 초에는 AI-Q 설계도와 3월경 추가 통합을 포함한 더 넓은 범위의 기업용 에이전트 AI 플랫폼에 대한 초기 계획을 발표했다.

엔비디아의 CEO인 젠슨 황(Jensen Huang)은 이 이정표를 간결하게 평가하며 "슈퍼 에이전트가 등장했다"고 말했다. 반면 랭체인의 CEO인 해리슨 체이스(Harrison Chase)는 모델 자체를 단순히 확장하는 것보다 모델 주변에 견고한 시스템을 구축하는 것의 중요성을 강조하며 더 미묘한 시각을 제시했다.

글로벌 전문 서비스 거대 기업인 EY는 프로덕션 배포에 참여하는 기업 파트너 중 하나다. Baseten과 Fireworks AI는 추론 서빙을 담당하고 있다. EY의 참여는 주요 컨설팅firm들이 고객들을 위해 이러한 시스템을 기반으로 실무 능력을 구축하고 있음을 시사하며, 빅포(Big Four)가 특정 기술을 제품화하기 시작하면 기업 도입 속도가 일반적으로 급격히 가속화된다.

원문 보기
Nvidia, LangChain과 함께 NemoClaw Deep Agents 청사진… · Slicast