스페이스XAI는 Grok 모델에 NVIDIA Vera CPU를 채택했으며, 스타마인드 임무를 통해 궤도에 Vera Rubin NVL72 시스템을 배치할 계획이다.
Hot Chips 2026에서 Groq 3 LPX 발표와 함께 NVIDIA는 SpaceXAI가 차세대 에이전트형 AI 애플리케이션 가속화를 위해 NVIDIA Vera CPU를 도입할 것이라고 밝혔다. 해당 기업은 또한 기가와트 단위의 용량으로 확장함에 따라 Vera Rubin 플랫폼 위에서 Grok의 기반 인프라를 확대하고, 최적화된 Vera Rubin NVL72 시스템을 기반으로 한 첫 세대 Starmind AI 위성을 통해 해당 아키텍처를 궤도로 확장할 계획이라고 덧붙였다.
이러한 프레임워크는 가속기 관련 발표로 가득 찬 한 주 동안 특히 두드러진다. NVIDIA는 에이전트가 모델 호출 사이에서 도구 조정, 코드 실행, 데이터 처리 및 시뮬레이션을 수행하므로 기존 추론보다 에이전트형 애플리케이션이 CPU에 더 크게 의존한다고 주장한다. 이러한 워크로드를 과소하게 Provisioning하면 에이전트 루프가 느려지고 GPU가 유휴 상태에 머무르게 된다.
NVIDIA는 Vera를 AI 에이전트를 위해 특별히 설계된 최초의 CPU로 설명하며, 모델 추론을 둘러싼 CPU 집약적 작업을 대상으로 한다고 밝혔다. 이 칩은 NVIDIA가 설계한 Olympus 코어 88개, NVIDIA Spatial Multithreading, 그리고 최대 1.2TB/s 대역폭을 제공하는 고대역폭 LPDDR5X 메모리를 특징으로 한다. NVIDIA는 에이전트형 AI, 강화 학습, 데이터 처리 워크로드 전반에 걸쳐 x86 CPU 대비 최대 1.8배 빠른 작업 완료 속도를 달성한다고 주장하지만, 이는 벤더 제공 수치로서 독립적인 검증이 필요하다. 이러한 사양은 이전에 공개된 플랫폼 세부 사항과 일치하는데, 여기에는 176개의 스레드, 1.8TB/s의 NVLink-C2C 대역폭, 1.5TB의 시스템 메모리, 2270억 개의 트랜지스터가 포함된다.
"에이전트형 AI는 답변을 생성하는 것뿐만 아니라 행동을 취하기 위해 설계된 새로운 유형의 컴퓨팅 시스템을 필요로 합니다,"라고 NVIDIA의 초확장 및 고성능 컴퓨팅 부사장인 Ian Buck은 말했다. "Vera는 AI 에이전트가 실시간으로 행동할 수 있는 CPU 성능을 제공하여 코드를 실행하고, 데이터를 처리하며, 복잡한 작업을 조정합니다. SpaceXAI는 이 아키텍처를 대규모 AI 공장에서 궤도상의 컴퓨팅 다음 최전선으로 가져가고 있습니다."
SpaceXAI는 NVIDIA가 개별 구성 요소로 출시하는 것이 아니라 컴퓨팅, 네트워킹, 소프트웨어 전반에 걸쳐 통합적으로 공동 설계한 Vera Rubin 위에 Grok의 기반 인프라를 구축할 계획이다. 이러한 통합 스택은 NVLink, Spectrum-X 이더넷, BlueField 데이터 처리를 결합하며, NVIDIA는 규모에 따른 토큰당 비용 절감을 위한 경로로서 이러한 통합 접근 방식을 제시하고 있다.
"Vera는 방대한 양의 오케스트레이션, 코드 및 데이터 처리를 실행하면서도 GPU가 가장 잘하는 일을 계속하도록 할 수 있는 CPU 성능과 메모리 대역폭을 제공합니다,"라고 SpaceXAI 사장인 Mike Nicolls는 말했다. "이는 더 고성능의 AI 에이전트와 컴퓨팅 와트당 더 유용한 작업을 의미합니다."
궤도 부품은 이번 발표의 더 예측 불가능한 측면을 대표한다. SpaceXAI는 전력, 열 관리, 대역폭, 신뢰성 및 물리적 통합에 대한 제약이 지상 데이터 센터와 극명하게 다른 우주용 AI 컴퓨팅 인프라를 개발 중이다. 그 계획된 첫 세대 Starmind 위성은 최적화된 Vera Rubin NVL72 랙 스케일 시스템을 기반으로 하며, NVIDIA와 SpaceXAI는 공통 아키텍처와 소프트웨어 생태계를 유지하면서 이러한 조건에 맞춰 설계를 적응시킬 예정이다.
NVIDIA는 이미 상당 기간 동안 이러한 능력을 구축해 왔다: GTC 2026에서 궤도 배치를 목표로 하는 Space-1 Vera Rubin 모듈을 선보였다. 그러나 Starmind 계획에는 타임라인, 발사 날짜 또는 용량 수치가 동반되지 않으며, NVIDIA는 전체 페이로드를 미래 지향적 진술로 분류했다.