Nvidia가 Hot Chips 2025 기술 회의에서 최신 Blackwell GPU 혁신 및 아키텍처 발전을 발표할 예정이다.
Nvidia Corporation은 Stanford University에서 8월 24-26일에 개최되는 Hot Chips 2025 컨퍼런스에서 GPU, 네트워킹, AI 효율성 분야의 주요 발전 사항을 공개하고 있습니다. 반도체 설계 컨퍼런스에서는 랙 규모 AI 시스템, 신경 렌더링, 효율성 중심 훈련 방법의 최신 혁신을 선보일 예정입니다. Nvidia 임원진은 데이터 센터를 위한 랙 규모 아키텍처 설계에 관한 튜토리얼을 포함하여 6개 세션을 진행하며, 주요 주제는 회사의 Spectrum-XGS 네트워킹 플랫폼, NVLink Fusion 기술, 차세대 Blackwell GPU를 다룹니다.
여러 위치에서 AI 모델 훈련 및 추론에 대한 증가하는 수요를 해결하기 위해 Nvidia는 Spectrum-XGS Ethernet을 도입하여 여러 데이터 센터를 대규모 AI 슈퍼팩토리로 연결하고 있습니다. 이 솔루션은 다중 사이트 AI 워크로드에서 성능을 거의 두 배로 향상시키며, 공동 패키징된 옵틱스 스위치는 전력 소비량과 지연시간을 줄이는 것을 목표로 합니다. Nvidia의 주요 아키텍트 Idan Burstein은 대규모 고속 GPU 간 통신을 지원하는 Nvidia 네트워킹 스택의 핵심 요소인 ConnectX-8 SuperNIC에 대해 상세히 설명할 것입니다.
Nvidia의 아키텍처 담당 시니어 디렉터 Marc Blackstein은 회사의 Blackwell 아키텍처가 추론 및 시뮬레이션 성능을 어떻게 향상시키고 있는지 강조할 것입니다. GeForce RTX 5090 GPU는 게임 및 시각화를 위한 신경 렌더링 개선 사항을 제공하며, Nvidia DLSS 4는 설계 사이클 및 사실감에서 최대 10배의 성능 향상을 제공합니다. 또 다른 혁신인 NVFP4 4비트 부동소수점 형식은 정확도를 손상시키지 않으면서 AI 훈련 효율성을 4배 증가시킬 것을 약속하며, 대규모 언어 모델 훈련에서 획기적인 발전을 나타냅니다. Nvidia의 시니어 디스팅귀시드 엔지니어 Andi Skende는 GB10 Superchip으로 구동되는 DGX Spark 데스크톱 AI 슈퍼컴퓨터를 선보일 것이며, 연구자와 개발자에게 컴팩트한 폼 팩터로 고성능 AI 기능을 제공합니다.
Nvidia는 TensorRT-LLM, PyTorch, vLLM을 포함한 오픈소스 AI 도구에 대한 지원을 지속적으로 확대하고 있으며, GPT-OSS 및 Meta Platforms, Inc.의 Llama 4와 같은 인기 있는 오픈 모델에 대한 NIM 마이크로서비스도 제공하고 있습니다. $4.34 트릴리언 이상의 기업 가치를 지닌 Nvidia는 Blackwell 플랫폼과 성장하는 네트워킹 포트폴리오로 AI 칩 시장에서 계속 지배적 위치를 유지하고 있습니다. UBS와 Wedbush 애널리스트들은 Nvidia의 B200, GB200, 예정 중인 GB300 GPU에 대한 높은 수요와 증가하는 하이퍼스케일 지출 및 대규모 인프라 프로젝트를 언급하며 낙관적입니다. 회사는 8월 27일 실적 보고를 예정하고 있습니다.