Nvidia가 전통적인 클라우드 데이터센터 범위를 넘어 AI 추론 및 엣지 컴퓨팅 기능을 발전시켰습니다.
NVIDIA는 오늘 업계 최초의 독립적인 AI 추론 벤치마크 스위트인 MLPerf Inference 0.5에서 가장 빠른 결과를 기록했으며, 데이터 센터용 NVIDIA Turing™ GPU 및 엣지 컴퓨팅용 NVIDIA Xavier™ 시스템온칩의 성능을 입증했습니다. 이 결과는 7월 AI 훈련을 위한 여러 MLPerf 0.6 벤치마크 승리에 이어 NVIDIA가 훈련 성능에서 8개의 기록을 세운 최근 AI 벤치마크에서의 강력한 성능을 계속해서 보여주는 것입니다.
MLPerf의 5가지 추론 벤치마크는 다양한 폼팩터와 4가지 추론 시나리오에 적용되며, 이미지 분류, 객체 탐지 및 번역을 포함한 확립된 AI 애플리케이션을 다룹니다. NVIDIA는 데이터 센터 중심 시나리오(서버 및 오프라인) 모두에서 5가지 벤치마크를 모두 선도했으며, Turing GPU는 상용 제품 중에서 프로세서당 가장 높은 성능을 제공합니다. Xavier는 엣지 중심 시나리오(단일 스트림 및 멀티 스트림) 모두에서 상용 엣지 및 모바일 SoC 중에서 가장 높은 성능을 제공했습니다.
NVIDIA는 5가지 MLPerf 벤치마크 모두에 결과를 제출한 유일한 AI 플랫폼 회사로 차별화되었습니다. 동사의 NVIDIA GPU는 Alibaba Cloud, AWS, Google Cloud Platform, Microsoft Azure 및 Tencent을 포함한 세계 최대의 클라우드 인프라에서 대규모 추론 워크로드를 가속화합니다. Walmart 및 Procter & Gamble을 포함한 세계 최고 수준의 기업 및 기관은 NVIDIA의 EGX 엣지 컴퓨팅 플랫폼과 AI 추론 기능을 사용하여 엣지에서 정교한 AI 워크로드를 실행하고 있습니다.
NVIDIA의 모든 MLPerf 결과는 데이터 센터에서 엣지까지 프로덕션 환경에서 AI 애플리케이션을 최적화하고 배포하는 고성능 딥 러닝 추론 소프트웨어인 NVIDIA TensorRT™ 6을 사용하여 달성되었습니다. 새로운 TensorRT 최적화도 GitHub 저장소에서 오픈 소스로 제공됩니다. 추론 플랫폼을 확장하면서 NVIDIA는 MLPerf Inference 0.5 벤치마크에 사용된 Xavier SoC의 저전력 버전을 기반으로 구축된 엣지에서의 로봇 및 임베디드 컴퓨팅 장치를 위한 세계에서 가장 작고 강력한 AI 슈퍼컴퓨터로 설명되는 Jetson Xavier NX를 출시했습니다.