AMD가 Nvidia의 Rubin 플래그십 AI 가속기와 직접 경쟁하도록 설계된 새로운 GPU 아키텍처를 공개했다.
AMD는 대규모 AI 학습 및 추론을 위해 설계된 플래그십 프로세서인 Instinct MI4555X 가속기를 출시했으며, 이는 Nvidia의 Rubin GPU에 직접적인 도전장을 내민 것이다. AMD의 Advancing AI 2026 행사에서 공개된 MI455X는 회사의 Instinct MI400 시리즈의 새로운 플래그십을 대표하며, Helios 랙 규모 AI 플랫폼의 핵심 동력이 될 예정이다. 시장 점유율에서는 Nvidia에 뒤처지고 있지만, AMD는 GPU 기술 분야에서 경쟁력 있는 수준을 입증했다.
MI455X는 3,200억 개의 트랜지스터, 432GB의 HBM4 메모리, 최대 40 petaflops의 FP4 AI 연산 성능을 자랑한다. 주요 사양 측면에서 MI455X는 Nvidia의 Rubin과 동등하거나 이를 상회한다. Rubin은 약 50 PFLOPS의 FP4 성능을 제공할 것으로 예상되지만, HBM4 메모리는 288GB에 불과하여 MI455X보다 50% 적다. 또한 AMD는 최대 23.3 TB/s의 메모리 대역폭을 제공한다고 주장하며, 이는 Rubin의 22 TB/s를 약간 상회하는 수치이다.
AMD의 차세대 CDNA 5 아키텍처를 기반으로 한 MI455X는 수년간 회사에서 가장 중요한 가속기 재설계를 의미한다. TSMC의 2nm 및 3nm 공정 기술로 제조된 이 칩은 3D 하이브리드 본딩으로 연결된 고급 칩렛 설계를 채택했다. 이 아키텍처는 텐서 처리, 캐시 대역폭, 메모리 이동, 실행 효율성 등을 개선하여 대규모 언어 모델(LLM)과 에이전트형 AI 워크로드의 가속화를 목표로 한다.
최대 40 PFLOPS의 FP4 성능과 20 PFLOPS의 FP8 연산 능력을 갖춘 MI455X는 현재 Instinct MI350 세대의 AI 연산 능력을 약 두 배로 끌어올린다. 또한 HBM 메모리 대역폭도 기존 MI350의 약 8 TB/s에서 새로운 가속기의 23 TB/s 이상으로 크게 증가했다.
Nvidia와 AMD 모두 GPU를 단독 제품으로 포지셔닝하던 시대를 넘어섰다. 대신 이들은 CPU, 네트워킹, 보안, 소프트웨어를 포함한 종합 컴퓨팅 시스템의 구성 요소로서 GPU를 마케팅하고 있다.
Nvidia의 DGX 플랫폼에 대응하는 AMD의 Helios 랙 규모 플랫폼은 72개의 GPU를 하나의 통합 시스템으로 연결한다. 완전히 구성된 Helios 랙에는 Instinct 가속기, EPYC 프로세서, Pensando 네트워킹, 그리고 ROCm 소프트웨어 스택이 탑재된다. AMD는 이 플랫폼이 최대 31TB의 HBM4 메모리와 최대 2.9 exaflops의 FP4 AI 연산 능력을 제공한다고 주장한다.
MI455X는 Nvidia와의 하드웨어 격차를 상당히 좁혔다. 제원상 이 가속기는 Rubin보다 훨씬 더 많은 메모리를 갖춘 채 경쟁력 있는 AI 연산 성능을 제공하며, 이는 점점 더 거대해지는 AI 모델을 학습하려는 고객들에게 매력적으로 다가갈 조합이다.
Instinct MI455X는 2026년 3분기 말부터 출하가 시작되며, 4분기와 2027년 상반기까지 물량 생산이 확대될 예정이다.