Huawei Cloud는 구이양에서 열린 2026 중국 국제 빅데이터 산업 박람회에서 풀체인 AI 대응 데이터 인프라 역량을 공개했다.
8월 28일, 구이양에서 열린 ‘2026 중국 국제 빅데이터 산업 박람회’의 일환으로 개최된 데이터 요소 컨퍼런스에서는 “데이터에서 에이전트로: 데이터 가치 사슬의 재구성과 혁신”을 주제로 정부 기관, 선도적인 빅데이터 그룹, 산업 기업 및 학계 전문가들이 모여 데이터 요소의 시장 기반 배분, 고품질 데이터셋 구축, 신뢰할 수 있는 데이터 공간, 그리고 AI 시대의 데이터 인프라 혁신에 대해 논의했습니다.
대규모 언어 모델과 에이전트의 산업 전반 침투가 가속화됨에 따라 근본적인 변화가 진행 중입니다. 모델과 에이전트가 데이터의 새로운 소비자가 된 것입니다. 이러한 소비 패턴의 변화는 빅데이터 플랫폼이 전통적인 레이크하우스에서 멀티모달 레이크하우스와 데이터 에이전트로 진화하도록 유도하며, 이는 AI 시대의 데이터 인프라에 완전히 새로운 요구사항을 부과하고 있습니다.
“데이터는 AI의 핵심 연료이며, AI는 데이터 가치의 방출을 촉진합니다.”라고 화웨이 하이브리드 클라우드 회장은 컨퍼런스에서 언급했습니다. AI 산업이 에이전트 시대로 진입함에 따라 데이터는 AI 모델 진화와 에이전트 성장을 이끄는 핵심 연료가 되었습니다. 화웨이 클라우드 스택은 주요 산업 분야의 고객에게 데이터 전 주기를 아우르는 포괄적인 데이터 기능 시스템을 제공하여, 기업이 과거에 분산되어 축적된 데이터를 효과적으로 활용하고, 데이터를 자원에서 생산력으로 전환하며, 그 진정한 가치를 해방할 수 있도록 지원합니다.
역사적으로 기업 데이터는 클라우드, 데이터 센터, 생산 라인 및 사무 시스템 전반에 광범위하게 분산되어 있었습니다. 데이터 통합 없이는 에이전트가 핵심 비즈니스 운영에 침투하기 어렵습니다. 따라서 기업의 전체 데이터 포트폴리오를 AI가 실제로 접근 가능하게 만드는 것이 디지털 및 지능형 전환을 위한 새로운 필수 과제로 부상했습니다.
이러한 변화에 대응하여 화웨이 클라우드는 ‘하이브리드 클라우드 + 데이터 + AI’ 전략과 화웨이 클라우드 스택 하이브리드 클라우드 기반을 활용하여, 신뢰할 수 있는 데이터 관리, 효율적인 데이터 공급, 지능형 데이터 활용, 그리고 신뢰할 수 있는 데이터 순환을 아우르는 풀체인 기능을 구축했습니다. 이 아키텍처는 AI 준비 완료(AI-Ready) 데이터 플랫폼 구축을 지원합니다.
신뢰할 수 있는 데이터 관리는 AI를 위한 견고한 기반을 마련합니다. 빅데이터 엔진은 모든 시나리오에서 가용 영역(AZ), 리전, 클라우드 간 재해 복구를 지원하며, 메타데이터 관리는 수억 건의 레코드에 대한 통합 제어를 제공합니다. 저장, 컴퓨팅, 관리 계층의 아키텍처 분리(Decoupling)를 통해 시스템은 데이터의 신뢰성, 관리 용이성 및 비용 효율성을 보장합니다.
효율적인 데이터 공급은 데이터를 AI가 즉시 사용할 수 있는 ‘연료’로 변환합니다. 멀티모달 지능형 데이터 레이크인 화웨이 클라우드 AI DataLake은 세 가지 핵심 엔진의 시너지를 바탕으로 AI 데이터 공급망의 병목 현상을 제거합니다. 모델 학습과 에이전트 추론에 맞춰 설계된 이 솔루션은 데이터 공급 효율성을 종합적으로 업그레이드하여, 기존 업계의 느린 전달, 제한된 볼륨, 낮은 정밀도 및 약한 호환성 등의 오랜 통증을 해결합니다.
지능형 데이터 활용은 데이터를 원시 정보에서 논리로, 궁극적으로 행동으로 격상시킵니다. 복잡한 기업 데이터 시나리오를 위해 설계된 화웨이 클라우드의 지능형 데이터 의사결정 플랫폼 DataArts는 IT 시스템 데이터, OT 생산 데이터, ET 엔지니어링 데이터 및 KT 기업 지식의 ingestion을 통합합니다. 40개 이상의 내장 데이터 처리 오퍼레이터, 자기 진화 오ントロジー 구축 지원 및 고성능 컴퓨팅 기능을 갖춘 DataArts는 데이터 마이그레이션 없이도 효율적인 데이터 접근과 활용을 가능하게 합니다.
신뢰할 수 있는 데이터 순환은 완전한 가치 실현을 열어줍니다. 데이터 주권 통제 불가, 참여자 신원 검증 불가, 감사 불가능한 프로세스 등의 과제에 대응하기 위해 화웨이 클라우드는 프라이버시 컴퓨팅, 데이터 API, 데이터 샌드박스 및 블록체인 기술을 활용하여 신뢰할 수 있는 데이터 순환 환경을 조성합니다. 이를 통해 데이터 흐름이 완전히 추적 가능하고, 통제 가능하며, 검증 가능하도록 보장합니다. 이러한 기능은 이미 상하이 도시 데이터 공간, 난퉁 홈 텍스타일 산업 데이터 공간, 윈난 통신 투자 등 프로젝트에 배포되었습니다.
‘데이터 잘 관리하기’에서 ‘데이터가 AI를 서비스하도록 함’으로의 전환은 패러다임 변화를 의미합니다. 데이터는 정적 자산에서 지속적으로 모델과 에이전트 진화를 주도하는 생산력으로 진화하며, 이는 데이터 가치 사슬을 재정의합니다.
기술 패러다임은 궁극적으로 산업 실무를 통해 검증되어야 합니다. 컨퍼런스에서 XCMG 그룹, 광둥 전력 그리드, 양쯔강 삼각주 데이터 체인, 구이저우 슈주바오는 데이터 거버넌스, 고품질 데이터셋 생성, 신뢰할 수 있는 순환 및 데이터 가치 운영 전반에 걸쳐 데이터가 어떻게 더 나은 방식으로 AI를 서비스하는지를 보여주는 현장 구현 사례를 발표했습니다.
건설 기계 부문 선도 기업인 XCMG 그룹은 2023년 ‘스마트 전환, 디지털화 및 네트워킹’ 전략적 전환을 시작했습니다. 이 이니셔티브에 의해 안내되고 ‘1+4+2’ 프레임워크와 4대 주요 엔지니어링 프로젝트를 중심으로 구조화된 XCMG는 데이터 요소를 제품 개발, 제조 및 운영 사슬에 깊이 통합했습니다. 이에 따라 데이터 거버넌스는 단순히 ‘데이터 조직화’를 넘어 기업 지능화를 위한 견고한 데이터 기반을 마련하는 단계로 발전했습니다.
데이터 기반이 공고해짐에 따라 다음 과제는 AI가 ‘소비하고 학습할 수 있는’ 고품질 데이터를 형성하는 것이 됩니다. 광둥 전력 그리드는 ‘Yi Wan Wan’ 다차원 태깅 시스템을 개발하여 ‘사전 라벨링 + 수동 미세 조정 + 다차원 태깅’ 워크플로우를 통해 지능형 라벨링을 구현했습니다. 고객 서비스 시나리오에서 표준화된 스크립트의 스마트 추천은 일일 2만 건 이상의 통화에서 적용되었으며, 정확도는 98%에 달합니다.
데이터가 단일 조직을 넘어 이동할 때, 보안적이고 신뢰할 수 있는 순환이 가치를 해방하는 열쇠가 됩니다. 양쯔강 삼각주 데이터 체인은 ‘블록체인 + 프라이버시 컴퓨팅’을 중심으로 한 ‘1+1+1+X’ 아키텍처를 구축했습니다. 현재 232개 참여 기관을 보유하고 있으며, 140개의 애플리케이션 시나리오를 커버하고, 43억 건의 블록체인 트랜잭션을 처리했으며, 9개 성 및 40개 도시의 물류 노드를 상호 연결했습니다.
데이터가 흐름을 시작하면서 새로운 형태의 가치가 나타납니다. 구이저우 슈주바오의 CEO 주린은 “데이터의 종착지는 보고서가 아닌 토큰이다”라고 지적했습니다. 50개 이상의 부처와 국, 그리고 1,800개 이상의 데이터 제품을 활용한 데이터 소스를 바탕으로 슈주바오는 통합된 ‘데이터 + 컴퓨팅 + 토큰’ 플랫폼을 구축했습니다. 그 자회사인 TopenRouter는 일일 1,000억 건 이상의 호출을 처리하는 독립적인 토큰 거래 플랫폼을 운영하며, 화웨이와 ‘베이스 × 운영’ 협력 모델을 수립했습니다.
데이터 거버넌스와 고품질 데이터셋부터 신뢰할 수 있는 순환 및 가치 운영에 이르기까지 새로운 경로가 형성되고 있습니다. 데이터는 이제 거버넌스, 보고 및 분석에서 멈추지 않습니다. 대신 지속적으로 모델과 에이전트에 피드백을 제공하여 실제 비즈니스 운영 내에서 새로운 가치 고리를 형성합니다.
행사 기간 중 구이저우 성 공공 데이터 자원 ‘원레이크(One Lake)’ 프로젝트의 공동 혁신 출시가 발표되어, 공공 데이터의 효율적 집계와 지능형 프로비저닝 가속화를 목표로 했습니다. 동시에 ‘데이터 요소 시나리오 공동 혁신 액션’이 공개되어, 궈타이신디안, 스팡웨이예, 구이저우 슈주바오, 화아오 데이터, 스타더스트 에라, 슈신 테크놀로지, 융훙 테크놀로지, 쉬위 테크놀로지 및 프리메이션 인포메이션을 포함한 산업 파트너들을 모아 실제 시나리오에서 데이터 요소 가치의 방출을 촉진했습니다.
이러한 이니셔티브 뒤에는 데이터 부문에서의 화웨이 클라우드의 지속적인 축적이 자리 잡고 있습니다. 최근 몇 년간 화웨이 클라우드는 구이저우 빅데이터 그룹과 제휴하여 성 단위의 공공 데이터 ‘원레이크’를 설립하고 AI 신뢰 데이터 공간에 대한 공동 성과를 발표했습니다. 상하이에서 공공, 산업 및 기업 데이터의 효과적인 통합을 촉진했고, XCMG와 함께 제조업 신뢰 데이터 공간 시범 사업을 선구적으로 수행했으며, 베이징, 선전, 장쑤 등지에서 도시 단위 데이터 공간과 AI를 지원하는 고품질 데이터셋을 계속 탐색하고 있습니다.
기관과 기업은 지역적으로 축적된 핵심 데이터, 비즈니스 프로세스 및 산업 노하우를 보호하면서도 빠르게 진화하는 AI 능력을 지속적으로 접근해야 한다는 이중 의무를 안고 있습니다. 화웨이 클라우드 스택의 하이브리드 클라우드 아키텍처는 클라우드, 데이터 센터 및 생산 현장 전반에 분산된 데이터를 연결하여, 안전하고 통제된 경계 내에서 효율적인 데이터 흐름을 가능하게 하면서 동시에 모델 학습, 에이전트 실행 및 지능형 의사결정을 지속적으로 지원합니다.
중요하게도, 기업의 비즈니스 데이터, 상호작용 데이터 및 지능형 경험은 자체 AI 데이터 레이크 내에 계속 축적될 것이며, 이는 ‘데이터가 모델 진화를 주도하고, 비즈니스에 투입된 모델이 새로운 데이터를 생성한다’는 선순환 고리를 확립합니다. 이러한 피드백 루프를 통해 기업 AI는 사용함에 따라 점진적으로 더 똑똑해집니다.
지능형 시대를 앞두고 화웨이 클라우드는 클라우드 인프라, 데이터 및 AI 기술에 대한 투자를 계속 확대할 예정입니다. ‘하이브리드 클라우드 + 데이터 + AI’ 접근 방식을 활용하여 신뢰할 수 있는 관리, 효율적인 공급, 지능형 활용 및 신뢰할 수 있는 순환의 풀체인을 연결함으로써, 화웨이 클라우드는 고객 및 파트너와 함께 데이터 인프라의 진화를 지속적으로 추진할 것입니다.