Tuesday, September 15, 2026
AI 인프라 · 뉴스 & 분석
반도체·하드웨어리포트
반도체·하드웨어 · 리포트

NVIDIA의 Blackwell GPU 아키텍처 및 RTX 50-series 성능 개선에 대한 기술 분석입니다.

Blackwell은 차세대 컴퓨팅 기능을 나타내며 데이터센터 고객의 제품 로드맵 기대를 설정합니다.
업계 전문지Slicast · 2025년 1월 15일 12:00 UTC · 글로벌 · 출처: tomshardware.com
중요도 60

Nvidia는 CES 2025 에디터스 데이에서 다가오는 RTX 50-series GPU의 Blackwell GPU 아키텍처를 선보였으며, 7개 세션에 걸쳐 핵심 기능에 대한 광범위한 세부 사항을 제공했습니다. 회사는 Blackwell의 네 가지 주요 목표를 제시했습니다: 새로운 신경 워크로드 최적화, 메모리 풋프린트 감소, 새로운 서비스 품질 기능 도입, 에너지 효율 개선. 많은 업그레이드가 AI 및 신경 렌더링 기술에 초점을 맞추고 있지만, 전체 아키텍처는 RTX 40-series Ada Lovelace 세대와 비교하여 상당하지만 점진적인 변화를 보여줍니다. RTX 5090은 예외이며, 4090의 608 mm²과 비교하여 744 mm²의 상당히 더 큰 GPU 다이를 특징으로 합니다.

성능 개선은 의미있지만, 이전 세대 도약보다는 더 적습니다. RTX 5090은 "최대 4,000 AI TOPS"(초당 조 단위 연산)를 제공하며, 플래그십 소비자 카드에서 3,400 TOPS(정확히는 3,352)로 축소됩니다. 동일한 사양을 비교할 때, RTX 5090은 RTX 4090의 1,321 TFLOPS FP8 대비 1,676 TFLOPS FP8을 달성하며, 이는 27% 증가를 나타냅니다. 마찬가지로 RTX 5090은 RTX 4090의 82.6 TFLOPS FP32 대비 최대 104.8 TFLOPS FP32를 제공하며, 역시 27% 개선입니다. 이는 RTX 3090에서의 RTX 4090 전환과 대조되며, RTX 3090은 GPU TFLOPS에서 132% 증가를 제공했습니다. 5090 다이는 22% 더 크고 21% 더 많은 트랜지스터를 가지고 있으며, 둘 다 동일한 TSMC 4N 프로세스 노드에서 제조됩니다.

아키텍처적으로 Blackwell은 여러 주목할 만한 개선 사항을 도입합니다. 4세대 RT 코어는 이제 Ada의 광선-삼각형 교점 속도의 2배를 특징으로 하며, 향후 Unreal Engine 5 게임의 잠재적 개선을 위해 Mega Geometry를 지원합니다. Nvidia는 Blackwell의 모든 셰이더 코어를 완전한 FP32/INT32 호환으로 만들었으며, 이는 Ada에서 절반의 코어만 INT32 연산을 지원했던 것에서의 전환입니다. GPU 셰이더는 Neural Shaders를 위해 개선되었으며, 셰이더와 텐서 코어 연산의 더 나은 혼합을 허용하며, Shader Execution Reordering (SER)은 이제 Ada보다 Blackwell에서 2배 빠릅니다. Blackwell은 또한 80 Gbps에서 DisplayPort 2.1 UHBR20 및 PCIe 5.0을 지원하는 첫 번째 소비자 GPU 시리즈이며, 비디오 인코딩 및 디코딩은 4:2:2 비디오 스트림을 지원하도록 개선되었습니다.

메모리는 상당한 업그레이드 경로를 나타내며, Blackwell은 Ada 세대의 GDDR6 및 GDDR6X에서 완전한 GDDR7으로 전환됩니다—2018년 RTX 20-series 이후 첫 번째 주요 메모리 전환으로, 14 Gbps로 클록된 GDDR6을 도입했습니다. 대부분의 Blackwell RTX 50-series GPU는 28 Gbps에서 GDDR7을 실행하며, 이는 원래 GDDR6 칩보다 2배 빠르지만 고사양 RTX 40-series GPU에 사용된 21 Gbps GDDR6X 칩보다 33% 더 빠릅니다. RTX 5080은 30 Gbps GDDR7로 속도 향상을 받으며, 이는 2080 Super의 15.5 Gbps 메모리보다 거의 2배입니다. 증거는 이 GDDR7 전환이 라인업 전반에 걸쳐 보편적일 수 있음을 시사하며, RTX 5070 노트북 GPU도 8GB의 GDDR7을 특징으로 합니다.

원문 보기
NVIDIA의 Blackwell GPU 아키텍처 및 RTX 50-series 성능… · Slicast