Lambda Labs은 GPU 클라우드 클러스터를 통해 Nvidia H100 GPU의 온디맨드 가용성 제공
Lambda는 공식적으로 1-Click Clusters를 출시할 예정이며, 이는 고객들에게 Nvidia H100 GPU와 Quantum 2 InfiniBand 클러스터에 온디맨드로 접근할 수 있는 기회를 제공합니다. Nvidia와의 협력을 통해 Lambda는 2개부터 64개 노드까지 온디맨드로 제공 가능한 클러스터를 제공할 것입니다. 이러한 클러스터는 기업들이 필요한 만큼의 컴퓨팅 파워에만 접근할 수 있게 해주며, 특히 GPU를 24/7로 운영할 필요가 없는 경우에 유용합니다.
Lambda의 공동창업자이자 수익 담당 부사장인 Robert Brooks에 따르면, 이 서비스는 자체 모델을 구축하는 기업들이 직면한 중대한 과제를 해결합니다. "학습은 하드웨어와 소프트웨어 관점에서 정말 계산 엔지니어링 과제입니다"라고 Brooks는 VentureBeat에 말했습니다. "지금 AI 회사를 시작한다면, GPU의 대규모 클러스터를 갖추기 위해 많은 자금이 필요하며, 그것을 구축하기 시작하는 데만 해도 시간이 걸립니다." 대부분의 기업들은 이미 사전 학습된 기성 AI 모델을 사용하고 자신의 데이터와 거버넌스 정책으로 미세조정하는 것을 선택하며, 이는 주로 기초 모델을 구축하고 학습하는 것과 관련된 비용 때문입니다.
AI로 작업하는 소규모 기업들은 GPU 공간을 임대하거나 자신의 모델을 학습하는 데 필요한 프로세서에 접근하기 위해 클라우드 제공업체와 협력합니다. AWS 및 Microsoft Azure와 같은 클라우드 제공업체들이 AI 모델뿐만 아니라 Nvidia GPU에 대한 접근도 제공하지만, Brooks는 그러한 경우의 초점은 학습이 아닌 추론(AI 모델이 학습하는 대신 실제로 배포되는 경우)에 있다고 지적했습니다. 또한 GPU 클러스터를 사용하기 위한 계약은 보통 1년 이상 지속되며, 이는 단 몇 개월만 필요한 기업들에게는 부담스럽습니다.
Lambda는 특히 대규모 연구에 사용되는 Nvidia H100 GPU와 InfiniBand 네트워킹 같은 하드웨어를 새로운 모델 학습 프로젝트를 위해 온디맨드로 제공할 수 있는 방법을 찾아냈습니다. 1-Click 클러스터는 특히 단기간만 모델을 학습해야 하고 몇 개월 이상 사용하지 않을 수 있는 GPU에 대한 장기 계약을 체결할 수 없는 기업들을 대상으로 합니다. 기업들은 Lambda 클러스터에서 필요한 노드 수를 최소 2주일 동안 예약할 수 있으며, 가격은 노드 수와 필요한 기간에 따라 결정됩니다.
2012년에 설립된 Lambda는 2월에 3억 2천만 달러를 조달했으며, 이로써 기업 가치는 15억 달러가 되었습니다.