Qualcomm은 모바일 플랫폼에서 AI 처리와 그래픽 렌더링 간의 성능 트레이드오프를 해결하기 위해 설계된 전용 하드웨어 가속기인 Adreno Neural Fusion을 공개했다.
모바일 게임은 지난 10년 동안 콘솔급 비주얼, 흔들림 없는 프레임 레이트, 그리고 한 세션 내내 버틸 수 있는 배터리 수명을 동시에 요구해 왔다. 그 시간의 대부분 동안 사용자는 이 중 두 가지만 선택할 수밖에 없었다. 퀄컴의 새로운 모바일 렌더링 접근 방식은 이러한 구도를 바꾸고 있다. AI, 전용 실리콘, 그리고 고급 메모리 아키텍처를 결합함으로써 스냅드래곤은 이전보다 더 높은 시각적 충실도, 부드러운 게임플레이, 그리고 향상된 전력 효율성을 제공하고 있다.
이러한 변화의 중심에는 신경망 처리, AI 슈퍼 해상도, 프레임 생성을 단일 그래픽 파이프라인으로 통합하는 AI 기반 렌더링 기술인 'Adreno Neural Fusion'이 자리 잡고 있다. 역사적으로 모바일 업스케일링은 상당한 타협을 필요로 했다. Adreno Neural Fusion은 이러한 트레이드오프를 최소화하도록 설계되어 디테일과 모션 선명도를 유지하면서 게임을 더 효율적으로 실행할 수 있게 한다. 그 결과 렌더링 비용과 전력 소비가 줄어드는 가운데 더 높은 시각적 품질이 실현된다.
차세대 플래그십 플랫폼은 'Adreno Matrix Cores'를 도입했는데, 이는 고급 AI 모델을 그래픽 파이프라인 내에서 직접 실행하도록 설계된 AI 전용 GPU 코어다. 이는 Adreno에서 처음 시도된 것으로, 퀄컴의 AI 로드맵에서 중요한 이정표를 의미한다. 이제 매트릭스 가속화는 플랫폼의 주요 처리 엔진 전체(NPU, CPU, GPU)에 걸쳐 확장되었다. AI 워크로드를 그래픽 파이프라인 내부에 유지함으로써 개발자는 더 낮은 지연 시간과 감소된 전력 오버헤드로 점점 더 정교한 렌더링 모델을 실행할 수 있다. 신경 계산은 이제 처리되기 위해 그래픽 파이프라인을 벗어날 필요가 없다.
세 개의 슬라이스로 구성된 GPU 아키텍처에서 얻은 Adreno의 개선된 전력 및 효율성 이득을 기반으로, Adreno Matrix Cores는 18MB의 Adreno High Performance Memory(HPM)라는 전용 최적화 캐시와 짝을 이룬다. 고급 Adreno GPU 플랫폼에 통합된 HPM은 GPU에 대규모이고 저지연성 메모리를 직접 제공한다. 이를 통해 타일 기반 렌더링, 프레임 버퍼, 그리고 컴퓨팅 워크로드가 그래픽 서브시스템 내에 국소적으로 유지될 수 있다. 근접 메모리 설계 방식을 채택한 세 개의 슬라이스는 중간 결과를 칩 내부에 보관하여 시스템 메모리에 반복적으로 액세스하지 않도록 한다. 데이터 전송 횟수가 줄어들면 지연 시간이 짧아지고 효율성이 높아지며, 이는 곧 더 긴 게임 세션으로 이어진다—플레이어가 눈으로 보지는 못하지만 즉시 체감할 수 있는 아키텍처적 장점이다.
개발자에게 있어 채택은 순수 성능만큼이나 중요하다. Adreno Neural Fusion은 Unity와 Unreal Engine을 포함한 주요 게임 엔진 전반에서 지원되는 상용화된 최초의 모바일 AI 슈퍼 해상도 기술이다. 스튜디오는 맞춤형 구현체를 구축하거나 미래의 엔진 로드맵을 기다리지 않고도 기존 워크플로우에 고급 AI 강화 렌더링을 통합할 수 있다. Adreno Neural Fusion으로 개발할 때 창작자들은 플래그십 GPU 성능, AI 기반 렌더링, 그리고 바로 사용할 수 있는 엔진 레벨 지원을 얻을 수 있다. 이를 통해 모바일 기기에서 bespoke 렌더링 솔루션을 처음부터 구축하지 않아도 더 풍부한 그래픽, 고급 조명, 그리고 높은 이미지 품질을 구현할 수 있다. 더 많은 타이틀이 이 기술을 채택함에 따라 스냅드래론 탑재 기기는 향상된 이미지 품질, 부드러운 게임플레이, 그리고 더 효율적인 성능의 혜택을 받게 된다. 목표는 여전히 명확하다: 게임을 더 잘 보이게 하고, 더 빠르게 실행하며, 더 적은 전력을 소비하게 하는 것이다.
스냅드래론에서의 모바일 AI 처리 미래는 어떨까? 이번 출시물은 단독 기능이 아닌 더 넓은 산업적 전환의 시작점을 나타낸다. 매트릭스 가속화가 이제 NPU, CPU, GPU 전반에 걸쳐 확장되면서 AI 처리는 구성 요소별 추가 기능에서 플랫폼 전체의 능력으로 진화하고 있다. 이러한 근본적인 변화는 향후 혁신의 토대를 마련한다. 효율성을 극대화하는 핵심은 연산 작업을 실리콘 근처에 유지하는 것이다. Adreno Matrix Cores는 그래픽 렌더링이 발생하는 정확한 위치에서 AI 모델을 처리하며, 18MB의 Adreno HPM은 타일, 프레임 버퍼, 컴퓨팅 작업 등 무거운 데이터셋을 칩 내부에 저장하여 시스템 메모리로의 지속적인 셔플링을 제거한다. 데이터 이동이 적어지면 지연 시간이 짧아지고 효율성이 좋아져, 이는 직접적으로 더 긴 게임 세션으로 이어진다.
수년간 모바일 게임은 플레이어와 개발자가 시각적 충실도, 성능, 또는 배터리 수명 중 하나를 희생하도록 강요해 왔다. Adreno Neural Fusion은 이러한 타협을 obsolete하게 만들도록 설계되었다. 이것이 바로 AI에 의해 구동되고 스냅드래론을 위해 네이티브로 구축된 모바일 그래픽의 다음 장이다.