Nvidia Ampere A100 GPU를 발표하여 생산 중인 가장 빠른 GPU에 대한 새로운 성능 기록을 설정합니다.
NVIDIA의 플래그십 Ampere GPU인 A100은 OTOY가 개발한 벤치마크 도구인 OctaBench에서 사상 최고 성능의 GPU로 새로운 기록을 세웠습니다. OctaBench는 Octane Renderer를 사용하여 GPU 성능을 평가합니다. 이 성과는 OTOY의 CEO인 Jules Urbach가 2020년 7월 23일에 공개했습니다. A100은 7nm 공정 기반의 세계 최대 규모 그래픽 칩으로, 5월에 공개된 이후 사양과 성능 지표가 계속해서 세계 기록을 경신하고 있습니다.
OctaBench 벤치마크에서 NVIDIA A100 Tensor Core GPU는 446점을 기록하며 경쟁 아키텍처 대비 상당한 성능 우위를 입증했습니다. Jules Urbach에 따르면 Ampere A100은 OctaneRender에서 Turing GPU보다 약 43% 빠르며, 특히 RTX가 비활성화된 상태에서도 이러한 성과를 달성했습니다. 벤치마크는 RTX가 비활성화된 표준 Linux OB4 벤치마크를 사용했으며 CUDA11을 위해 재컴파일되었고, 기준선은 980=102 OB입니다.
다른 고성능 GPU와 비교했을 때 A100의 우위가 명확합니다. A100의 선대 제품인 Tesla V100은 평균적으로 약 20% 느리고, Titan V는 11% 느립니다. 이러한 비교적 좁은 격차는 Titan V가 Tesla V100과 동일한 GV100 GPU를 사용하며 데이터센터 및 클라우드 규모 워크로드에 더 최적화되어 있을 가능성을 반영합니다. Titan RTX는 더욱 상당한 성능 차이를 보이며 A100보다 38% 느립니다. 이 비교는 일반적으로 게이밍과 GP-GPU 애플리케이션에 최적화된 Turing GPU가 이 특정 워크로드에서 데이터센터 중심 아키텍처인 Ampere와 다르게 성능을 발휘함을 보여줍니다.
A100의 인상적인 성능은 그 방대한 규모와 고급 설계에 기인합니다. 단일 다이 내에 540억 개의 트랜지스터가 집적된 A100은 지금까지 생산된 7nm 칩 중 단연 가장 큰 규모입니다. 현재 A100 구성은 초기 수율로 인해 대폭 축소된 설계를 특징으로 하지만, 제조 기술이 개선됨에 따라 더 많은 코어를 포함한 상위 버전이 출현할 수 있으며, 이는 이 벤치마크에서 성능을 더욱 향상시킬 수 있습니다. 성능 향상의 잠재력은 상당하며, 이러한 이득은 테스트 환경에서 RTX 가속이 활성화되지 않은 상태에서 달성되었습니다.
A100의 성과가 미치는 광범위한 영향은 NVIDIA의 소비자 중심 Ampere 라인업까지 확대됩니다. Ampere 아키텍처 기반의 소비자용 그래픽 카드 출시를 기다리는 시장에서 OctaBench에서 입증한 성능은 GeForce RTX 30 시리즈 카드가 RTX 가속이 활성화되면 HPC 대응 제품의 성능에 가까울 수 있음을 시사합니다. A100의 이 특정 벤치마크에서의 우위는 Ampere가 다양한 워크로드에서 제공할 상당한 세대 간 비약의 강력한 지표입니다.