Huawei와 Cambricon이 Nvidia의 중국 시장 점유율을 빠르게 확보하는 국산 칩 주도
새로운 진입자들이 국내 최고 GPU 시장에 조용히 합류하고 있습니다.
최근 언론 보도에 따르면 ByteDance는 Daysci와 주로 추론 작업을 위해 최소 50,000개의 AI 칩을 구매하기 위한 협상을 진행 중입니다. 협상 대상인 칩들은 주로 Daysci의 Zhika 시리즈 클라우드 추론 GPU이며, Tiangai 시리즈는 학습 시나리오에 사용됩니다.
이 소식은 시장을 흔들었습니다. 결국 ByteDance는 국내 최대 AI 컴퓨팅 파워 조달 주체이며, 2026년 자본 지출을 200억 위안 이상 증대할 계획이기 때문입니다.
그러나 현재로서 ByteDance와 Daysci 모두 응답하지 않았습니다.
이 거래가 구체화된다면 Daysci는 Huawei와 Cambricon 다음으로 ByteDance의 국내 GPU 공급업체 중 3위가 될 것입니다.
올해 1월 홍콩에 상장한 Daysci에게 이것은 단순히 대규모 주문의 문제가 아니라 '주요 기술 기업의 인증'을 얻는 것이 더 중요합니다.
그러나 주문 자체보다 더 주목할 가치가 있는 것은 이 사건 뒤에 있는 신호입니다. 국내 AI 칩이 정말로 '정책 주도 조달 및 산업 파일럿'에서 주요 인터넷 회사들의 응용 시나리오로 전환되고 있으며, 대체 옵션에서 필수 컴퓨팅 파워 지원으로 전환되고 있다는 것입니다.
현재 미국은 통제된 조건 하에서 특정 중국 기업들이 Nvidia H200을 구매하는 것을 허가합니다. 그러나 H20 '백도어 사건'은 중국 구매자들의 조달 결정에 규정 준수 및 보안 검토 압력을 추가했습니다. 주요 국내 기술 회사들에게 모든 계란을 한 바구니에 담지 않는 것이 표준 관행이 되었습니다.
더욱 중요하게도 ByteDance의 컴퓨팅 파워 수요는 구조적 변화를 겪고 있습니다.
QuestMobile 데이터에 따르면 2026년 3월 기준 ByteDance의 AI 어시스턴트인 Doupo는 월 활성 사용자 3억 4,500만 명에 도달했습니다. 사용자 성장의 압력은 모델 학습뿐만 아니라 출시 후 지속적인 추론 비용에서도 비롯됩니다. 추론 시나리오에서는 칩이 학습 시나리오와 비교할 때 상호 연결 대역폭, GPU 메모리 및 생태계 성숙도에 대한 요구 사항이 덜 엄격합니다. 국내 칩은 추론 측면에서 사용 가능한 수준에 도달했습니다.
2026년 3월 기준 Doupo의 대규모 언어 모델 일일 평균 토큰 호출 수는 120조를 초과했으며, 이는 초기 출시 당시와 비교해 천배에 달합니다. Volcano Engine의 가격 책정 및 사용자 행동 계산에 기반하면, 일일 컴퓨팅 파워 소비 비용은 수천만 위안에 도달했습니다. 지능형 컴퓨팅 센터 및 칩 구매와 같은 일회성 투자는 포함되지 않습니다.
Doupo 2.0이 추론 효율을 43% 개선했고 백만 토큰당 비용이 해외 선도 모델의 규정 준수 경로의 38%에 불과하지만, 3억 4,500만 월 활성 사용자가 무료로 사용할 때 컴퓨팅 비용 감소를 통해 손실 격차를 메우지 못합니다.
이러한 압력 속에서 ByteDance는 '대규모' 투자를 시작했습니다.
남중국경제신문을 인용한 여러 매체 보도에 따르면, ByteDance의 2026년 AI 인프라 자본 지출 예산은 약 25% 증가하여 200억 위안이 되었습니다. 이 증가는 주로 두 가지 요인으로 인한 것입니다. 하나는 인공지능에 대한 회사의 지속적인 투자 증대이고, 다른 하나는 메모리 칩 비용의 상승입니다.
다른 보도에 따르면 ByteDance는 2026년 지출 상한선을 70억 미국 달러로 올릴 것을 검토 중입니다. 한편 2025년 회사의 순이익은 전년도 대비 70% 이상 감소했습니다. 이익과 지출 사이의 이러한 거대한 격차에 직면하여 Zhang Yiming의 컴퓨팅 파워에 대한 대담한 베팅은 향후 5년간 회사의 위치를 확보하기 위한 것일 수 있습니다.
ByteDance의 컴퓨팅 파워 공급망 전략은 명확합니다. 학습을 위해 Huawei Ascend 및 Cambricon의 고급 학습 카드를 사용하고, 추론을 위해 Daysci의 Zhika 시리즈를 도입하며, 세 가지 경로가 병렬로 실행됩니다. '두 다리의 병렬 학습 및 추론, 국내 및 수입 칩의 이중 백업'이라는 이 접근 방식은 주요 인터넷 회사들의 '표준 구성'이 되고 있습니다.
그러나 ByteDance의 국내 칩 조달 계획이 헤드라인을 장악하는 동안, 또 다른 국내 GPU 제조업체의 움직임은 더 많은 주목을 받을 자격이 있습니다.
6월 16일 저녁, Zhipu는 차세대 플래그십 대규모 언어 모델 GLM-5.2를 공식 오픈 소스했습니다. 다음날 Birev Technology와 Moore Threads는 연이어 '0일' 적응 완료를 발표했습니다. Birev Technology의 Bili 166 시리즈는 vLLM 추론 프레임워크를 기반으로 적응 최적화를 완료했으며, 개발자들에게 빠른 배포 솔루션을 먼저 제공했습니다. 발표 후 Birev Technology의 주가는 그날 7.09% 상승했습니다.
'0일 적응'은 국내 GPU의 경쟁 구도를 이해하는 핵심입니다. 이는 모델이 칩 출시 당일에 칩에서 실행될 수 있음을 의미합니다. 이것은 칩 제조업체가 뛰어난 하드웨어뿐만 아니라 소프트웨어 스택, 도구 체인 및 개발자 생태계와 보조를 맞춰야 함을 보여줍니다. 이 측면에서 Birev Technology는 이미 명확한 선발 우위를 가지고 있습니다.
Tencent Hunyuan Hy3 미리보기, Alibaba Tongyi Qianwen Qwen3.6, DeepSeek의 전체 시리즈, MiniMax M3, Zhipu GLM의 전체 시리즈, Kimi를 포함한 20개 이상의 선도적인 국내 대규모 언어 모델이 모두 Birev Technology의 칩과 '0일' 수준의 동기화된 적응을 완료했습니다. DeepSeek은 특히 주목할 가치가 있습니다. 보도에 따르면 Birev는 수 시간 내에 전체 시리즈의 적응을 완료하여 국내 칩 대응 속도의 기록을 세웠습니다.
이 적응 목록을 ByteDance의 공급업체 목록과 겹쳐 놓으면, 명확한 신호가 나타납니다. Birev Technology는 이제 Huawei 및 Cambricon과 나란히 설 수 있습니다.
Huawei는 오랫동안 선도적인 위치를 유지해왔습니다. Ascend의 생태계 깊이와 10,000카드 클러스터 기능은 다른 국내 제조업체들이 맞추기 어려운 벤치마크로 남아있습니다. Cambricon은 일찍 진입했으며 ByteDance에 꾸준히 칩을 공급해왔으며, 주요 기술 회사들의 컴퓨팅 파워 공급망의 핵심 플레이어로 역할합니다. 새로운 힘으로서 Birev Technology는 국가 수준의 인증, 자본의 호의, 대규모 언어 모델 생태계 배포를 통해 이전의 두 회사와의 동등성을 달성했습니다.
2026년 5월, 국가는 보안 및 신뢰성 평가에서 처음으로 전용 AI 칩 카테고리를 수립했습니다. 이 중 Huawei HiSilicon, Alibaba Pingtouge, Birev Technology, Hongmeng Information, Daysci, Mushi Information, Moore Threads 등 9개의 국내 칩 기업이 최고 보안 및 신뢰성 수준인 1등급을 달성했습니다. 국가 수준의 인증 좌표계에서 Birev Technology는 Huawei 및 Alibaba Pingtouge와 나란히 서 있습니다.
자본 시장의 투표는 더욱 직접적입니다. Birev Technology는 2026년 1월 2일 홍콩 증권 거래소에 상장했으며, 공개 주가가 82% 급등했고, 시가총액이 일시적으로 100억 홍콩 달러를 초과했으며, 홍콩의 첫 GPU 주식이 되었습니다.
이 '친구 집단'의 가치는 긍정적 피드백 루프를 형성하는 것입니다. Birev Technology 칩에서 실행되는 모델이 많을수록 소프트웨어 스택이 더 성숙해집니다. 소프트웨어 스택이 더 성숙할수록 새로운 모델 적응이 더 빨라집니다. 적응이 빠를수록 Birev를 선택하려는 모델 공급업체가 많아집니다. 이것이 생태계의 '플라이휠 효과'입니다.
물론 Birev Technology는 혼자가 아닙니다. 전체 국내 GPU 트랙은 대규모 언어 모델 적응 중심의 군비 경쟁에 참여하고 있습니다.
앞서 언급했듯이 Huawei Ascend의 생태계 깊이는 동료 기업들이 맞추기 어렵습니다. 이번에 Zhipu GLM-5.2와 Ascend의 추론 적응은 0일에 완료되었습니다. Cambricon은 DeepSeek-V4 출시 당일에 0일 적응을 완료했습니다. ByteDance의 두 주요 GPU 공급업체 중 하나로서 NeuWare 소프트웨어 스택의 영향력은 계속 확대되고 있습니다.
6월 이후 Moore Threads는 MiniMax M3 및 Zhipu GLM-5.2의 같은 날 적응을 지속적으로 완료했으며, MTT S5000의 대응 속도는 모든 경쟁사와 일치합니다.
Shuiyuan Technology는 클러스터 방향에 초점을 맞춥니다. Tencent Cloud와 함께 '료약' 지능형 컴퓨팅 파워 클러스터 상용 버전 3.0을 공동 출시했으며, DeepSeek, Tencent Hunyuan, Zhipu AI를 포함한 주류 대규모 언어 모델에 이미 적응했으며, 1,000카드 및 10,000카드 클러스터 배포를 완료했습니다.
주목할 가치가 있는 것은 Shuiyuan Technology가 6월 15일 규제 승인을 통과했다는 것입니다. 성공적으로 상장하면, '국내 GPU의 네 마리 용' — Moore Threads, Mushi Information, Birev Technology, Shuiyuan Technology — 이 자본 시장에 처음으로 모일 것입니다.
만약 개별 뉴스 보도만 본다면 쉽게...