TSMC는 생산능력 부족으로 백로그에 10억 개 칩을 축적했고, DeepSeek는 공급 부족 속 추론 API 가격을 인상했다.
8월 6일, 화웨이 펠로우이자 반도체 수석 과학자 리아오 헝은 인터뷰에서 "현재 칩은 거의 모든 곳에 존재합니다. 일종의 '물'과 '공기'만큼 중요해졌다고 할 수 있습니다"라고 밝혔습니다. 과학기술혁신 칩 ETF 후안 자사(588750)가 주목하는 국내 칩 산업 생태계의 핵심적 중요성은 명확합니다.
특히 AI 물결의 맥락에서 칩은 전례 없는 막대한 수요에 직면해 있습니다. 컴퓨팅 부족, 칩 품귀 현상 및 칩 인플레이션이 업계의 상식이 되었습니다. 딥시크의 드문 가격 발표와 앤트로픽의 자체 개발 칩 발표는 이러한 추세를 더욱 확고히 뒷받침합니다.
앞으로 국내 대형 모델의 가속화된 반복 업데이트와 '국내 모델+국내 칩' 트렌드의 진전에 따라, 3D 스택킹 및 첨단 공정 등 국내 칩의 혁신적 돌파구는 국내 칩이 도약하여 양적·가격적 확장이라는 황금 발전기에 진입할 수 있게 합니다.
업계 소식통에 따르면, 애플의 A20 프로세서 수요를 충족하기 위해 고급 생산 능력을 확대 중인 TSMC는 DRAM 부족으로 인해 최종 패키징을 기다리고 있는 가치가 10억 달러에 달하는 애플 프로세서를 축적했습니다. 이는 DRAM 납입 완료 시까지 생산 완료를 기다려야 함을 의미합니다.
8월 6일, 딥시크는 향후 단기간 내에 딥시크 API 서비스에 대해 전반적인 가격 인상을 시행할 계획이며, 상당한 인상 폭이 예상될 것이라고 공지했습니다. 이 조치는 여러 요인에 의해 추진됩니다.
첫째, 피크 시간대 호출량과 동시 접속자가 지속적으로 급증하며 컴퓨팅 자원이 심각한 제약에 처해 있습니다. OpenRouter의 주간 랭킹에 따르면 V4-Flash 호출량이 7.22조 토큰으로 선두를 차지하고 있습니다. 오픈소스 프로젝트인 OpenCode에 따르면 8월 1일 하루만으로도 일일 사용량이 8조 토큰에 도달했으며, 8월 4일에는 '전례 없는 트래픽'으로 인해 용량 부족이 발생했습니다.
둘째, 수요 폭발기에 추론 비용 구조(GPU/HBM/전기/운영)가 상승합니다. 과거 '극저가 + 대량 처리' 방식이 마진을 침식했으므로, 이제 '지속 가능한 현금 흐름 + 가치 기반 가격 책정'으로 회귀해야 합니다.
셋째, 업계 전반의 최저 가격선이 상승합니다. 국내 클라우드 벤더들과 다수의 모델 제공업체들이 올해 여러 차례 가격을 인상했으며, 딥시크의 인상은 '저가 기준점'을 상향 조정하여 업계가 '저가 경쟁'에서 '성능/안정성/ROI 지불'로 전환되도록 유도합니다.
단기적으로 이는 부하 분산과 핵심 사업 안정화에 도움이 됩니다. 중기적으로는 가격 상향이 모델 측의 현금 흐름을 회복시켜 상류 컴퓨팅 및 인프라에 피드백되며, '컴퓨팅 렌탈—국내 컴퓨팅—애플리케이션'이라는 긍정적 파동 효과를 촉진합니다.
AI 대형 모델은 학습 및 추론 컴퓨팅 수요를 폭발적인 수준으로 끌어올렸습니다. 막대한 칩 수요를 충족하고 공급 안정성을 확보하기 위해 많은 AI 리더들이 '자체 개발 칩' 레이스에 뛰어들었습니다.
미디어 보도에 따르면, AI 스타트업 앤트로픽은 처음으로 공개적으로 클라우데 대형 모델을 위해 맞춤형 AI 칩을 제작할 전용 내부 팀을 구성하여 자체 개발 칩 전략을 공식적으로 시행하겠다고 확인했습니다. 이는 커스텀 하드웨어를 활용하여 컴퓨팅 부족 문제를 해결하고, 클라우데의 지속해서 증가하는 대규모 학습 및 추론 요구사항에 완전히 적응함으로써 확장형 배포를 위한 하드웨어 기반을 공고히 합니다. 이와 유사하게, 오픈AI는 이전에 첫 번째 자체 개발 AI 추론 칩인 자파뇨(Jalapeño)를 출시했습니다.
AI 물결 속에서 칩 수요는 얼마나 막대한가요? 골드만 삭스는 2026~2028년의 글로벌 AI 어셀러레이터 칩 수요를 각각 1,900만 개, 2,700만 개, 3,200만 개로 전망하며, 기존 예측 대비 14%~22% 성장을 제시했습니다.
정책 측면에서는 컴퓨팅 파워 네트워크 구축이 가속화되어 지역 간 및 산업 간 자원 효율적 배분이 가능해지고 있습니다. 전력망, 통신망, 도시 지하 인프라, 물류망 등 '6대 네트워크'(수자원, 전력망, 컴퓨팅 파워, 차세대 통신, 도시 지하 인프라, 물류망) 중 하나로, 컴퓨팅 파워 네트워크는 전국 단위의 컴퓨팅 자원 스케줄링을 통합하여 토큰당 비용을 절감하고 '국가 전력망'과 유사한 기반 인프라 역할을 수행합니다. 이는 직접적인 투자를 견인하며 승수 효과를 통해 AI, 빅데이터, 산업 인터넷 전반의 업그레이드를 촉발합니다. 2026년 상반기 중국 AI 독자 혁신 속도는 크게 가속화되었습니다: 최초의 완전 국산화 10만 카드 클러스터가 가동되었으며, 지능형 컴퓨팅 능력은 전년 동기 대비 2.8배에 도달했고, 국내 대형 모델 다운로드 수는 100억 건을 초과했으며, 국내 컴퓨팅 칩과의 빠른 적응도 가속화되었습니다. (출처: 갤럭시 증권 20260805《산업 주간 보고서: 컴퓨팅 파워 네트워크 구축 가속화, 국내 AI 풀체인 속도 향상》)
AI 모델 관점에서 보면, 국내 대형 모델은 집중적인 업데이트에 주력하고 있으며 국내 컴퓨팅 파워 논리는 계속 강화되고 있습니다. 중신 증권은 최근 딥시크, 바이트댄스 시던스, 미니맥스, 문샷이 집중적인 업그레이드를 진행했다고 지적했습니다: 딥시크-V4-Flash가 코덱 적응 기능을 갖춘 API 오픈 베타를 정식 출시했으며, 바이트댄스 시던스 2.5, 시위 미니맥스 H3, 키미 K3는 비디오 생성, 멀티모달 기능 및 파라미터 규모에서 동시에 돌파구를 마련했습니다. 모델 개발은 '파라미터 쌓기 및 Q&A'에서 에이전트(Agent) 기능, 낮은 추론 비용 및 다중 모델 조정 방향으로 전환되었으며, 이는 AI 호출이 저빈도 Q&A에서 고빈도, 복잡하고 다단계 작업으로 이동할 가능성을 시사합니다. 가격 인하가 반드시 총 컴퓨팅 수요를 억제하지는 않습니다. 호출량 성장이 단위 토큰 비용 절감을 초과하고, 에이전트의 다중 라운드 계획 및 도구 호출이 더 높은 토큰 소비를 유발한다면 추론 컴퓨팅 수요에는 여전히 상승 여지가 있습니다.
국내 모델의 경쟁력이 개선되고 애플리케이션이 기업 생산 워크플로우에 침투함에 따라, 수혜자는 GPU에서 CPU, AI 서버, 스토리지, 스위치, 광모듈, PCB, 액체 냉각, 데이터 센터 및 전력 인프라로 확대되고 있습니다. 국내 컴퓨팅 파워 풀체인에 대한 우호적 논리는 계속 강화되고 있습니다. (출처: 중신 국제 증권 2026-08-05《컴퓨터 산업 주간 해독: 국내 모델 + 국내 컴퓨팅 파워 수렴, AI 애플리케이션 + 국내 컴퓨팅 파워 하드웨어 지속 수혜》)
기술 측면에서는 슈퍼 노드가 컴퓨팅 파워 업그레이드를 주도합니다. IT홈 보도에 따르면, 텐센트클라우드(Q4 2026)에 대규모 국내 컴퓨팅 파워 배치 및 슈퍼노드 배치를 계획하고 있습니다. 텐센트클라우드는 슈퍼노드 규모의 확장에 따른 대역폭 및 전력 병목 현상을 극복하기 위해 광 인터커넥트를 핵심으로 보고 있습니다. NPO는 국내 GPU가 슈퍼노드를 구축하기 위한 실용적인 경로입니다. CPO와 비교할 때 NPO는 광전자 변환 칩을 컴퓨팅 칩과 동일한 보드에 배치하여 메인 칩까지의 거리를 단축하고 광모듈에서 DSP 칩을 제거합니다.
WAIC 2026은 국내 GPU 경쟁이 단일 카드 성능에서 슈퍼노드, 클러스터, 소프트웨어 생태계 및 애플리케이션 배포에 걸친 시스템적 경쟁으로 전환되었음을 보여줍니다. 바이렌텍, 스레드스, 엔플레임, 뮉시, 라이트닝스타는 대규모 상호 연결, 백플레인리스 설계, 범용 GPU, 오픈소스 생태계 및 상업화 성과를 집중적으로 시연했습니다. 국내 컴퓨팅 파워는 '우리가 가지고 있는가'에서 '잘 사용할 수 있는가'로 진전되었으며, 업계의 초점은 '칩을 만드는 것'에서 '칩을 잘 사용하는 것'으로 이동했습니다. (출처: CITIC 점두 20260725《주간 관점: 국내 컴퓨팅 파워 공급-수요 공명》)
AI 인프라 슈퍼사이클은 여전히 유망하며, 스토리지, CPU, 웨이퍼 및 고급 패키징의 공급-수격 격차는 모두 기대치를 상회합니다. 과학기술혁신 칩 ETF 후안 자사(588750) 지수는 컴퓨팅 파워(CPU/GPU/ASIC) 86% plus 스토리지 plus 고급 제조업으로 구성되어 있어 순수 플레이 칩 기회에 매우 집중되어 있습니다. 20CM 가격 변동은 높은 모멘텀 트랙의 성장을 쉽게 포착할 수 있게 합니다. 장외 투자자들은 연동 펀드(A: 020628; C: 020629)를 추적할 수 있으며, 이는 7*24시간 거래 가능합니다.
보다 정밀한 국내 컴퓨팅 파워 및 스토리지 포지셔닝을 위해서는 과학기술혁신 칩 디자인 ETF 후안 자사(589290)를 고려하십시오. 이 ETF는 컴퓨팅 파워(CPU/GPU/ASIC) 72% plus 스토리지 비중을 보유하고 있습니다. AI 컴퓨팅 수요 폭발, 스토리지 칩 가격 사이클, 국내 대체라는 삼중 공명 하에, AI 물결 및 자립 필요성 속에서 국내 컴퓨팅 파워 및 스토리지 체인의 역사적 기회를 충분히 누릴 것으로 예상됩니다. 20CM 변동은 이러한 슈퍼사이클을 쉽게 포착하는 데 도움이 됩니다.