Nvidia의 중국용 H20 칩이 미-중 기술 경쟁과 지정학적 긴장의 초점이 되었습니다.
Nvidia의 HGX H20 AI GPU는 회사 수익의 극히 일부만을 차지하고 있음에도 불구하고, 비즈니스 미디어에서 불균형적으로 큰 주목을 받으며, H100이나 B200 같은 훨씬 더 강력하고 수익성 높은 프로세서에 대한 보도를 훨씬 능가하고 있습니다. 이러한 주목은 주로 미국-중국 무역전쟁에서의 중심적 역할에서 비롯됩니다. Biden 행정부 하에서 HGX H20은 Nvidia가 수출 허가 없이 중국에 출하할 수 있는 몇 안 되는 AI 워크로드용 GPU 모델 중 하나였습니다. 그러나 Trump 행정부는 이를 지정학적 도구이자 연방 수입원으로 활용했습니다. 한편, 중국은 Nvidia GPU가 미국 의무 추적 기능이나 백도어를 포함하고 있는지 조사하는 것으로 알려져 있으며, 중국 기업들에 H20 수입 중단을 요청했으며, 이는 Nvidia의 수익을 손상시킬 가능성이 있습니다. 이러한 발전들은 Trump 행정부가 Nvidia가 Blackwell 기반 AI 프로세서를 중국 기업들에 판매하도록 허용할지를 검토하고 있는 가운데 일어나고 있습니다.
Nvidia의 중국 GPU 판매 제한은 Biden 행정부가 국가 안보상 이유로 슈퍼컴퓨터급 하드웨어 출하를 차단한 2022년에 시작되었습니다. Nvidia는 NVLink 대역폭을 각각 400 GB/s와 450 GB/s로 축소한 축소 버전인 A800과 H800을 출시하여 대응했으며, 상호연결 토폴로지 옵션이 제한적이고 다중 GPU 확장이 제약되었습니다. 성능 측면에서 이들은 전기능 변형과 경쟁력 있는 수준을 유지했습니다. 2023년 말까지 중국 기업들은 제한을 극복하고 AI 훈련을 위해 H800 칩을 효과적으로 배포하여, 국내 대체재보다 수년 먼저 Nvidia의 Hopper 아키텍처에 접근했습니다. 이에 대응하여 Biden 행정부는 데이터 센터용으로 설계 또는 판매되는 프로세서를 다루는 수출 행정 규정(EAR) 규칙 3A090.a와 데이터 센터용으로 설계 또는 판매되지 않는 프로세서를 다루는 3A090.b를 시행하여, 중국으로 출하되는 모든 컴퓨팅 하드웨어에 총 처리 능력(TPP)과 성능 밀도(PD) 제한을 도입했습니다.
이러한 제한을 준수하기 위해 Nvidia는 GH100, AD102, AD104 실리콘을 축소하여 HGX H20, L20 PCIe, L2 PCIe 제품을 생산했습니다. 결과적으로 HGX H20은 AI 워크로드에서 H100보다 3.3–6.69배 느렸고, FP64 정밀도를 필요로 하는 HPC 워크로드에서는 34–67배 성능이 낮았습니다. AMD는 Instinct MI308 프로세서로 뒤따랐습니다. 이러한 제약에도 불구하고 H20은 중국 설계 AI 프로세서와 경쟁력 있는 수준을 유지하고 있으며, Huawei의 랙 규모 AI 시스템이 Nvidia의 주력 제품인 GB200 NVL72를 능가합니다. SemiAnalysis에 따르면 중국의 초대형 클라우드 서비스 제공업체들은 Nvidia의 CUDA 소프트웨어 스택의 효율성과 국내 솔루션을 초과하는 실제 성능으로 인해 수십억 달러 규모의 H20 프로세서를 열정적으로 구매했습니다.
전 세계 및 중국 AI 하드웨어 분야에서 Nvidia의 지배력은 이러한 프로세서를 지정학적 도구로 변모시켰습니다. 올해 초 Biden 행정부는 5월 15일에 발효될 예정인 AI Diffusion Rule을 도입했으며, 중국과 러시아로의 고급 GPU 수출을 금지하면서 다른 국가들에는 다소 덜 제한적인 규칙을 시행할 것을 제안했습니다. Trump 행정부가 AI Diffusion Rule을 폐지했지만 Nvidia의 하드웨어는 미국-중국 무역 협상에서 핵심 협상 도구로 남아 있습니다. 이 규칙은 세계를 세 가지 라이선싱 계층으로 나누었을 것입니다: 첫 번째는 미국과 18개 긴밀한 동맹국으로 구성되어 H100 같은 고급 칩에 대한 무제한적 접근이 가능했을 것이고, 두 번째는 발트해 3국, 이스라엘, 폴란드 같은 긴밀한 동맹국을 포함한 100개 이상의 국가를 포함했을 것이며, 직접 협상을 통해 검증된 최종 사용자(VEU) 승인을 받지 않는 한 수년에 걸쳐 약 50,000개의 H100급 GPU로 제한되었을 것입니다.