General Compute deploys Cerebras AI accelerators for ultra-fast inference in agentic coding tasks.
General Compute와 Cerebras Systems는 오늘 Cerebras의 초고속 추론을 대규모로 배포하기 위한 다년간 계약을 발표했습니다. 대체 칩 배포를 목적으로 구축된 네오클라우드인 General Compute는 AI 코딩 어시스턴트와 자율 소프트웨어 에이전트를 개발하는 개발자 및 기업으로 구성된 성장하는 고객 기반에 Cerebras 기반 추론을 제공할 예정입니다.
에이전트 코딩은 이 파트너십의 첫 번째 사용 사례를 나타냅니다. 이 워크플로우에서 코딩 에이전트는 코드를 계획, 작성, 테스트 및 수정하기 위해 여러 개의 순차적 추론 호출을 하며, 이는 전체 프로세스에서 지연 시간이 누적됨을 의미합니다. General Compute의 플랫폼을 통해 Cerebras 추론을 통합함으로써 고객은 이러한 지연 시간에 민감한 워크로드가 요구하는 반응성을 얻게 됩니다.
"인공지능에서 속도는 생산성입니다. 작업을 완료하는 데 수백 단계를 거치는 에이전트는 가장 느린 단계만큼만 빠릅니다."라고 Cerebras의 CTO이자 공동 창립자인 Sean Lie가 말했습니다. "General Compute와의 협력을 통해 개발자들이 이미 신뢰하는 플랫폼 위에서 에이전트 구축자들에게 Cerebras의 속도를 제공하게 됩니다."
이 파트너십은 AI 인프라가 자금을 조달하는 방식의 구조적 변화를 반영합니다. 최근까지만 해도 몇몇 조직만이 대규모로 AI 시스템을 구매할 수 있었습니다. 오늘날 Cerebras 같은 대체 가속기는 자금 조달 가능한 자산이 되었으며, 대출 기관들은 점점 더 이러한 구매에 자금을 지원하고 있어 General Compute 같은 네오클라우드가 자본 지출이 아닌 자금 조달을 통해 하드웨어를 획득할 수 있게 합니다. 이 모델은 추론 서비스 제공자에게 자신의 재무제표에 하드웨어를 보유하지 않으면서도 Cerebras를 사용하여 프리미엄 초고속 토큰을 배포할 수 있는 더 빠르고 유연한 방법을 제공합니다.
"우리는 가장 필요로 하는 워크로드를 위해 가장 빠른 추론 실리콘을 활용하도록 General Compute를 구축했습니다."라고 General Compute의 공동 창립자이자 CEO인 Finn Puklowski가 말했습니다. "에이전트 코딩이 가장 명확한 예입니다. 에이전트는 수천 개의 순차적 호출을 하며, 지연 시간이 누적되어 실제 소요 시간이 됩니다. Cerebras는 속도를 제공하고, 우리 고객은 이를 개발자에게 전달하며, 이 계약은 네오클라우드가 이 하드웨어를 대규모로 자금 조달하여 배포할 수 있음을 보여줍니다."
Cerebras 웨이퍼 스케일 추론은 Q1 2027부터 General Compute를 통해 제공될 예정입니다. General Compute는 최근 Upper90으로부터 $400M 대출 기구를 체결했습니다.