Tuesday, September 15, 2026
AI 인프라 · 뉴스 & 분석
반도체·하드웨어리포트
반도체·하드웨어 · 리포트

Nvidia가 에이전트 AI 워크로드 최적화 Blackwell Ultra 변형으로 아키텍처 개편

Blackwell 제품 확장이 효율적 추론 대안의 추론당 비용 압력 속 경쟁력 유지
업계 전문지Slicast · 2025년 3월 19일 12:00 UTC · 글로벌 · 출처: siliconangle.com
중요도 76

Nvidia Corp.의 GTC 2025 이벤트에서 인공지능 에이전트가 주요 화제를 장악했으며, 회사는 차세대 AI 추론 워크로드를 지원하기 위해 설계된 최신 GPU 플랫폼 진화인 Nvidia Blackwell Ultra를 공개했습니다. 회사는 이 플랫폼을 AI 개발자용 첫 Blackwell 기반 데스크톱 컴퓨터와 함께 발표했습니다. Blackwell Ultra는 1년 전 발표된 원본 Blackwell 아키텍처의 상당한 업그레이드를 제공하며, AI 학습 및 추론 워크로드 모두의 성능과 규모를 개선하고, 소위 AI 에이전트가 원하는 결과를 설명하는 간단한 프롬프트 이상의 노력 없이 자율적으로 작동하여 사용자를 위해 여러 종류의 작업을 수행할 수 있도록 합니다.

Blackwell Ultra는 72개의 최신 Blackwell GPU와 36개의 Arm Neoverse 기반 Nvidia Grace 중앙처리장치가 함께 작동하여 마치 하나의 초고성능 칩처럼 동작하는 Nvidia GB300 NVL72 랙 규모 솔루션을 포함합니다. Nvidia HGX B300 NVL16 베이스보드 시스템과 결합하면, 이 구성은 작년의 GB200 NVL72 랙 규모 설정보다 1.5배 더 우수한 AI 성능을 제공하며, 구식 Hopper 아키텍처 기반 GPU로 구동되는 시스템과 비교할 때 소위 AI 팩토리의 "수익 기회"를 최대 50배까지 증대합니다. Nvidia 최고경영자 Jensen Huang은 더 큰 컴퓨팅 성능 추진을 정당화하며 다음과 같이 말했습니다: "추론 및 에이전틱 AI는 획기적으로 증가된 수준의 컴퓨팅 성능을 요구합니다. 우리는 이 순간을 위해 Blackwell Ultra를 설계했습니다. 이는 사전 학습, 사후 학습 및 추론을 쉽고 효율적으로 수행할 수 있는 단일의 다목적 플랫폼입니다."

Blackwell Ultra 아키텍처는 Nvidia의 Spectrum-X Ethernet 및 Quantum-X800 InfiniBand 네트워킹 시스템을 포함하며, 이는 시스템의 72개 GPU 각각에 대해 초당 최대 800기가바이트의 데이터 처리량을 제공합니다. Nvidia의 BlueField-3 데이터 처리 장치 클러스터와 함께, 필수가 아닌 컴퓨팅 작업을 처리하여 GPU가 학습 및 추론에만 집중하도록 합니다. GB300 NVL72 시스템은 Amazon Web Services 및 Google Cloud를 포함한 주요 클라우드 제공자에서 실행되는 관리형 AI 인프라 서비스인 Nvidia DGX Cloud 플랫폼을 통해, 그리고 Nvidia DGX SuperPOD 하드웨어 시스템을 통한 온프레미스 배포를 통해 제공될 것입니다. Nvidia는 Cisco Systems Inc., Dell Technologies Inc., Hewlett Packard Enterprise Co., Lenovo Group Ltd. 및 Supermicro Computer Inc.를 포함한 주요 서버 파트너에게 Blackwell Ultra 아키텍처를 제공하고 있으며, AsusTek Computer Inc., Gigabyte Technology Co., Ltd., Pegatron Corp. 및 Inventec Corp.와 같은 추가 공급업체는 올해 말에 Blackwell Ultra 기반 서버를 판매할 계획입니다. 이 플랫폼은 또한 Amazon Web Services, Google Cloud, Microsoft Azure, Oracle Cloud Infrastructure 및 GPU 클라우드 제공자인 CoreWeave와 Crusoe에서 이용 가능합니다.

Nvidia는 또한 Blackwell GPU로 구동되는 첫 "개인용 AI 슈퍼컴퓨터"를 출시하여 다양한 위치에서 에이전틱 AI 개발을 가능하게 합니다. 이러한 시스템은 두 가지 형태로 제공됩니다—DGX Spark 및 DGX Station—Nvidia의 Project DIGITS의 일부로 개발되었으며 AI 개발자, 연구원 및 데이터 과학자가 대규모 언어 모델을 로컬에서 프로토타입, 미세 조정 및 실험하도록 설계되었습니다. Asus, Dell, HP 및 Lenovo를 포함한 회사들이 제작한 이러한 시스템은 5세대 텐서 코어 및 FP4 지원과 결합된 단일 Nvidia GB10 Grace Blackwell Superchip을 특징으로 하며, 초당 최대 1,000조 AI 연산을 처리할 수 있습니다. 이는 AI 개발자, 연구원 및 학생들에게 일반적으로 데이터 센터에서만 찾을 수 있는 것과 비교할 수 있는 AI 컴퓨팅 성능에 대한 로컬 접근을 제공합니다.

원문 보기
Nvidia가 에이전트 AI 워크로드 최적화 Blackwell Ultra 변형으로… · Slicast