NVIDIA DGX Spark 64GB为开发者提供更多构建和扩展本地AI的方式
本地AI随着令牌的增加变得越来越有用。
随着AI代理从实验阶段迈向日常开发,越来越强大的开源模型正在缩小以适应更多设备,使构建者能够在本地运行更多应用。
本月即将推出,NVIDIA DGX Spark将通过顶级制造商合作伙伴(宏碁、华硕、戴尔、技嘉、惠普和微星)提供64GB统一内存配置,为开发者、研究人员和AI爱好者提供一个新的配置,配备DGX OS和NVIDIA AI软件栈,从第一天就可以使用。
这个新的SKU在设备上运行功能强大的本地代理——私密地,无需云依赖。当工作负载增加时,两个单元可以通过NVIDIA Sync Cluster Assistant聚集在一起,无需任何额外设置。
个人AI超级计算的新起点
DGX Spark将NVIDIA Grace Blackwell计算、统一内存、NVIDIA ConnectX-7网络和NVIDIA CUDA加速的AI软件栈整合在一个系统中。它是一个用于代理、推理、微调、数据科学和边缘开发的完整本地AI平台。
这个紧凑的个人AI超级计算机为开发者提供了一个地方,可以用他们自己的数据实验模型,而不必为每个任务都转向云实例。
新的64GB配置仅从制造商合作伙伴处提供,在保持平台可访问价格的同时保留了GB10 Grace Blackwell超级芯片、DGX OS和完整的NVIDIA AI软件栈——与128GB模型相同。它支持多达1000亿参数的模型及其构建的agentic应用,完全在设备上运行。
两个64GB单元聚集在一起不仅仅是内存翻倍。在NVIDIA的Qwen 3.8 27B测试中,两个聚集在一起的64GB系统相比单个系统交付了高达1.7倍的性能,并且有空间继续随着工作负载需求进行扩展。
DGX Spark从第一天起就为代理开发做好了准备——NVIDIA Agent Toolkit、CUDA-X AI库、Nemotron开源模型以及Ollama、vLLM和PyTorch with CUDA等流行运行时都开箱即用支持。开发者可以在数分钟内从开机到运行模型。
Blender是首批支持该平台的主要创意应用提供商之一,预构建的可下载安装程序即将推出。
使用NVIDIA Sync Cluster Assistant扩展
开发者可以从他们的项目今天所需的内存开始,并建立在一个平台之上,该平台设计用于随着他们的流水线增长而无缝扩展多节点集群以处理更大的工作负载。
每个DGX Spark都配备了内置的NVIDIA ConnectX-7网卡,开箱即用。此外,两个单元可以直接通过QSFP线缆连接,将内存合并到128GB,并将模型支持扩展到多达2000亿参数,同时提供两倍的内存带宽和高达1.7倍的性能。
NVIDIA Sync应用程序无缝地配置这个多节点集群。集群助手功能检测连接的单元、验证设备配置并配置ConnectX-7网络,因此开发者可以专注于他们的工作而不是基础设施。每个节点都运行相同的NVIDIA软件栈,因此从一个单元扩展到两个时无需重新配置任何东西。
在月底即将推出,NVIDIA Sync Model Launcher使运行本地AI就像点击几个按钮一样简单。开发者可以在单个DGX Spark系统或集群上下载并启动Qwen3.8 27B,NVIDIA Sync将配置该模型以在连接的设备上运行,并使其可从用户的笔记本电脑访问。启动程序还将设置OpenCode以使用该模型,因此开发者可以在他们的浏览器中开始编码。
DGX Spark上的开发者用例
新的DGX Spark 64GB配置从第一天起就支持实际工作。通过完全在设备上运行多达1000亿参数的模型,开发者和爱好者可以从单个系统开始处理符合其内存范围的模型,或者使用NVIDIA Sync Cluster Assistant连接多个DGX Spark系统来处理需要更多内存和计算的工作负载。
以下是三个工作流示例:
全天候运行AI代理:在DGX Spark上保持编码或研究代理运行,准备好审查代码、分析文档或执行多步骤任务。集群为更大的模型、更长的上下文窗口或多个同时工作的代理提供额外的容量。
在您的日常PC上运行AI应用:在DGX Spark上运行语言或图像生成模型,同时在笔记本电脑或台式机上使用代理或创意应用。DGX Spark处理模型推理,释放PC用于其他工作。
工作量增加时进行扩展:当单个任务超过一个单元的容量时——运行更大的模型、更长的上下文窗口或并发代理请求——通过NVIDIA Sync Cluster Assistant连接在200 GbE结构上的两个DGX Spark 64GB系统将其内存合并到128GB。在一个单元上运行的相同工作流程可以扩展到两个,而无需重新配置软件环境。
DGX Spark入门指南
DGX Spark 64GB将于10月23日星期五从宏碁、华硕、戴尔、技嘉、惠普和微星开始提供,起价$4,999。
开始使用:
下载支持的推理框架——llama.cpp、Ollama、vLLM或LM Studio。
下载工作流的推荐本地模型。
要扩展到两个单元,通过它们的NVIDIA ConnectX-7端口连接它们并启动NVIDIA Sync Cluster Assistant——它自动配置网络并路由工作负载。
有关DGX Spark上的agentic AI剧本,请访问build.nvidia.com上的NemoClaw、OpenClaw、Hermes Agent和OpenShell页面。
#ICYMI:NVIDIA本地AI的更多更新
在build.nvidia.com/spark上探索DGX Spark的剧本。以下剧本即将在64GB设备上推出:
使用vLLM提供LLM
使用本地LLM运行OpenClaw
连接多个DGX Spark以实现分布式工作负载
新的由NVIDIA RTX Spark驱动的Windows PC将在本月由宏碁、华硕、戴尔、惠普、联想、微软和微星推出。注册RTX Spark通讯以接收未来的更新。