DeepSeek이 개발자들이 Nvidia 플랫폼 밖에서 CUDA 대체 생태계를 구축할 수 있도록 Huawei 칩용 소프트웨어 도구를 공개했다.
중국의 인공지능 회사 DeepSeek이 화웨이의 Ascend AI 칩을 위해 개발된 6개의 소프트웨어 도구를 오픈소스로 공개했습니다. 이는 미국의 수출통제로 첨단 미국 프로세서에 대한 접근이 제한되는 가운데, 중국 개발자들에게 국내산 대안을 제공하려는 것입니다. 항저우 소재 스타트업인 DeepSeek이 공식 위챗 계정을 통해 이번 공개를 발표했습니다. 이 패키지에는 컴퓨팅 및 통신 작업량을 위한 모듈이 포함되어 있습니다. DeepSeek은 이 도구들이 이전에 Nvidia 하드웨어를 위해 개발한 오픈소스 구성 요소를 바탕으로 하며, 현재 화웨이의 프로세서에 맞게 조정되었다고 말했습니다. 두 회사는 화웨이의 Ascend 950 가속기 128개를 기반으로 실행되는 슈퍼노드 시스템을 공동으로 개발했으며, 클러스터 전체에서 연산과 데이터 이동의 균형을 맞추도록 조정했습니다. 이번 공개는 단일 제품에만 의존하지 않고 GPU를 위한 독립적이고 통제 가능한 소프트웨어 생태계를 구축하려는 것입니다.
이번 공개의 중심은 Ascend 호환 버전의 TileLang입니다. TileLang은 모델 성능을 주도하는 중요한 커널을 작성하기 위한 DeepSeek의 고급 프로그래밍 언어입니다. Nvidia가 여전히 주요 백엔드로 남아 있지만, 이 언어는 이제 네이티브 코드 생성, 자동 스케줄링 및 동기화 기능과 함께 화웨이의 Ascend 950을 공식적으로 지원합니다.
DeepSeek은 TileLang을 Nvidia의 전용 CUDA 플랫폼에 대한 대안으로 포지셔닝했으며, 프로그래밍을 단순화하면서도 개발자들이 기본 하드웨어에서 최대한의 성능을 얻을 수 있게 해준다고 말했습니다. 회사는 이를 더욱 독립적인 GPU 소프트웨어 생태계를 향한 초기 단계로 표현했습니다.
CUDA를 대체하기 위한 과제는 막대합니다. Nvidia의 거의 20년에 가까운 도구 및 라이브러리 선도는 자사의 칩을 AI 워크로드에 필수적인 요소로 만들었으며, 아직 중국의 경쟁사 중 그 지배력을 깬 기업은 없습니다.
미국의 수출통제가 핵심 동인입니다. 제한으로 인해 중국 기업들의 Nvidia 최첨단 칩에 대한 접근이 제한되면서, 화웨이는 Ascend 프로세서 추진을 가속화했습니다. DeepSeek의 공개는 화웨이가 차세대 AI 프로세서와 슈퍼노드 시스템을 공개한 지 약 2주 후에 이루어졌으며, 내년에 모델 훈련을 시작할 예정입니다. 그 일주일 전 화웨이는 차세대 Ascend 960DT 칩을 발표했으며, 2027년 1분기에 출시될 예정입니다(원래 계획보다 3분기 앞당긴 것). 또한 2029년까지 확대되는 칩 로드맵도 공개했습니다.
화웨이의 회전식 회장 Eric Xu는 회사의 Ascend 칩이 이미 중국의 AI 칩 시장에서 Nvidia보다 더 큰 점유율을 차지하고 있다고 주장했지만, 뒷받침하는 수치는 제시하지 않았습니다.
DeepSeek과 화웨이의 파트너십이 올해 심화되었습니다. DeepSeek은 이전에 화웨이의 Ascend 프로세서에서 실행되는 V4 모델을 미리 보여주었으며, 이전의 Nvidia 의존도에서 벗어나고 있습니다. 화웨이는 전체 Ascend 라인업에서 V4 호환성을 보장하기 위해 DeepSeek과 협력했다고 밝혔습니다.
이 파트너십은 중국의 주요 AI 회사들이 수출 제한이 완화되기를 기다리기보다는 Nvidia의 부재에 적응하고 있는 방식을 보여줍니다. 남은 중요한 질문은 이러한 도구들이 개발자들을 CUDA에 묶어두었던 성능 격차를 얼마나 줄일 수 있는가입니다.