NVIDIA가 AI 클라우드 파트너를 위한 새로운 수익 공유 비즈니스 모델을 도입하여 대규모 추론 인프라를 제공하고 있습니다.
AI가 모델 개발에서 프로덕션 추론으로 전환됨에 따라 컴퓨팅 수요가 가속화되고 있으며 대규모 토큰을 생성하는 지속적으로 운영되는 AI 팩토리로의 전환이 이루어지고 있습니다. 이러한 변화는 빠르게 온라인 상태로 전환될 수 있고, 높은 활용도를 유지하며, 토큰 규모의 AI 서비스 경제를 지원할 수 있는 대규모 다중 테넌트 가속 컴퓨팅에 대한 액세스를 필요로 합니다.
신흥 AI 회사들은 역사적으로 자본 집약적 인프라에 대한 접근이 제한되어 있었으며, 장기 약정조차 컴퓨팅 자금 조달을 해제하기에 충분하지 않았습니다. 이를 해결하기 위해 NVIDIA는 스타트업, 모델 개발자, 엔터프라이즈, 연구 조직 및 지역 AI 플레이어로 구성된 빠르게 성장하는 AI 생태계에 컴퓨팅 액세스를 개방하는 새로운 비즈니스 모델을 도입하고 있습니다.
이 새로운 모델은 AI 클라우드가 수익 공유 및 신용 지원 모델을 통한 경제적 조정을 통해 AI 네이티브, 엔터프라이즈 및 ISV 고객을 위한 NVIDIA 인프라를 조달할 수 있게 합니다. 파트너십을 통해 AI 클라우드는 NVIDIA 기반 클라우드 서비스를 판매하며, NVIDIA는 표준 제품 수익과 지원되는 용량에 대한 클라우드 수익의 일부를 얻습니다. 이 구조는 빠르게 성장하는 고신념 AI 네이티브 부문 중 NVIDIA 플랫폼의 채택을 가속화하고 NVIDIA에 반복되는 사용 연계 수익 흐름을 제공합니다.
모델 개발자, 추론 제공자, 에이전트 플랫폼 및 AI를 확장하는 엔터프라이즈의 경우, 이는 사이트 선택, 전력 조달, 건설 및 하드웨어 설치를 기다릴 필요 없이 풀 스택 가속 컴퓨팅에 더 빠르게 액세스할 수 있음을 의미합니다.
Sharon AI와 Firmus는 이 새로운 비즈니스 모델로 NVIDIA와 협력하는 첫 번째 회사 중 하나입니다. Sharon AI는 최대 40,000개의 NVIDIA Grace Blackwell GB300 GPU를 배포하고 있습니다. Sharon AI의 공동 창립자 겸 CEO인 James Manning은 이 전략적 협력이 주권적 대규모 AI 컴퓨팅 인프라 제공이라는 Sharon AI의 미션에서 중추적인 순간이라고 말했습니다.
Firmus는 인도네시아 바탐에 360메가와트로 확장되고 최대 170,000개의 NVIDIA GPU를 보유할 것으로 예상되는 DSX AI 팩토리 캠퍼스를 건설 중입니다. Firmus Technologies의 공동 CEO인 Tim Rosenfield는 AI 네이티브 회사들이 전 세계적으로 경쟁하기 위해 확장 가능하고 에너지 효율적이고 비용 효율적인 컴퓨팅 인프라에 접근해야 하며, Firmus AI 클라우드가 고객들이 AI를 구축하고 확장하는 데 필요한 컴퓨팅에 접근할 수 있도록 돕기 위해 NVIDIA DSX 정렬 AI 팩토리를 구축하고 있다고 언급했습니다.
Baseten, Fireworks AI 및 Together AI와 같은 AI 네이티브 회사들은 컴퓨팅 수요가 어디로 향하고 있는지를 보여줍니다. 이들은 개발자, 디지털 네이티브 및 AI로 구축하는 엔터프라이즈를 위해 모델 훈련, 사후 훈련, 미세 조정 및 대규모 에이전트 추론을 실행하기 위해 AI 클라우드 용량에 즉시 액세스해야 합니다. 그들의 고객들은 사용량이 증가함에 따라 대규모 NVIDIA 가속 컴퓨팅에 대한 신뢰할 수 있는 액세스가 필요하지만, 제품이 파일럿에서 프로덕션으로 이동함에 따라 상용 유연성도 필요합니다.