Tuesday, September 15, 2026
AI 인프라 · 뉴스 & 분석
반도체·하드웨어리포트
반도체·하드웨어 · 리포트

Grok 4.5는 일부 벤치마크에서 성능이 뒤떨어지지만 Fable 5, GPT-5.5 대비 추론 비용이 4.2배 낮음; 효율성 분석은 비용-품질 트레이드오프를 강조합니다.

비용 최적화 프론티어 모델이 주목받고 있으며, 하이퍼스케일러와 스타트업이 추론 비용 대비 지연시간/정확도 요구사항을 재평가하고 있다.
업계 전문지Slicast · 2026년 7월 8일 19:01 UTC · 글로벌 · 출처: The Decoder
중요도 58

xAI는 코딩, 에이전트 작업 및 지식 작업을 위해 수만 개의 Nvidia GB300 GPU로 훈련된 Grok 4.5를 출시했다.

벤치마크 결과는mixed한 그림을 보여준다. 복잡한 명령줄 작업을 테스트하는 Terminal Bench 2.1에서 Grok 4.5는 83.3%의 점수를 기록하여 GPT-5.5의 83.4%에 거의 근접했으며, Anthropic의 Fable 5가 기록한 84.3%에는 단 1포인트 뒤졌다. 그러나 다른 영역에서는 격차가 벌어진다. 실제 GitHub 이슈 해결 능력을 측정하는 DeepSWE 1.1에서 Grok 4.5는 53%에 그쳐 GPT-5.5의 67%와 Fable 5의 70%보다 크게 뒤처졌다. 더 어려운 소프트웨어 엔지니어링 문제들로 구성된 선별형 세트인 SWE Bench Pro에서는 Grok 4.5가 64.7%의 점수를 기록했는데, 이는 일부 구성에서 Opus 4.8(69.2%)을 앞섰으나 최대 설정 시 69.2%를 달성하는 Opus 4.8과 Fable 5의 80.4%보다는 낮았다.

xAI는 데이터 품질 유지를 위해 훈련 중 강력한 데이터 필터링, 중복 제거 및 도메인 특화 선택을 활용했다고 밝혔다. 강화 학습 단계에서는 자동 채점 시스템을 통해 수십만 건의 소프트웨어 엔지니어링 작업을 다뤘다. xAI는 병렬 훈련이 진행되는 동안 에이전트 실행이 여러 시간 동안 지속될 수 있도록 비동기식 학습을 위한 훈련 인프라를 구축했다.

Grok 4.5의 가격은 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $6으로 경쟁사 대비 훨씬 저렴하다. Opus 4.8은 입력 토큰 100만 개당 $5, 출력 토큰 100만 개당 $25이며, Fable 5는 각각 $10, $50이다. GPT-5.5와 GPT-5.6은 입력 토큰 100만 개당 $5, 출력 토큰 100만 개당 $30이다.

xAI는 또한 Grok 4.5가 SWE Bench Pro 작업에서 Opus 4.8보다 4.2배 적은 토큰을 사용하며 초당 80개의 토큰 속도로 결과를 산출한다고 밝혔다. 낮은 토큰당 가격과 결합하면, 이러한 성능 및 효율성 개선이 실제 환경에서도 유지된다고 가정할 때 Grok 4.5는 이 성능 등급에서 압도적으로 저렴한 옵션이 된다.

이러한 가격 전략은 Zhipu와 DeepSeek 같은 중국 벤더들이 취해 온 방식과 유사하다: 성능으로 충분히 근접한 후 가격 경쟁력으로 승부한다.

Grok 4.5는 현재 Grok Build, Cursor, xAI 콘솔을 통해 이용 가능하며, Word, PowerPoint, Excel용 플러그인이 활성화되어 있다. EU 지역에서는 아직 제공되지 않으며, xAI는 7월 중순 출시를 목표로 하고 있다. xAI는 SpaceX가 6월 중순 주식 가치 기준 600억 달러에 인수한 코드 에디터 Cursor와 함께 Grok 4.5를 훈련했다.

원문 보기
Grok 4.5는 일부 벤치마크에서 성능이 뒤떨어지지만 Fable 5,… · Slicast