内容提要
英伟达推出DGX Spark 64GB版,10月23日起由宏碁、华硕、戴尔等厂商发售,起价4999美元。该设备搭载GB10超级芯片与统一内存,支持本地运行最高千亿参数模型,预装完整AI软件栈。两台设备可通过Sync Cluster Assistant互联,内存池化至128GB,性能提升最高1.7倍,支持两千亿参数模型。
延伸解读
64GB版与128GB版的差异与选择
文章指出,64GB版保留了与128GB版相同的GB10 Grace Blackwell超级芯片、DGX OS和完整NVIDIA AI软件栈,但统一内存减半,因此单机支持模型参数上限从128GB版的2000亿降至1000亿。对于模型规模在1000亿参数以内的开发者,64GB版提供了更低的入门价格;若需要运行更大模型,则需通过双机集群将内存池化至128GB。
双机集群的实际性能提升
两台64GB DGX Spark通过ConnectX-7直连并借助Sync Cluster Assistant配置后,内存池化至128GB,模型支持扩展至2000亿参数,内存带宽翻倍。在NVIDIA的Qwen 3.8 27B测试中,双机集群相比单机性能提升最高1.7倍,而非简单的两倍。这意味着集群主要解决内存容量和带宽瓶颈,性能增益因工作负载而异。
开箱即用的软件生态与扩展性
DGX Spark预装DGX OS和NVIDIA AI软件栈,支持Agent Toolkit、CUDA-X AI库、Nemotron开放模型以及Ollama、vLLM、PyTorch等流行运行时,开发者可快速上手。双机集群时,每个节点运行相同软件栈,无需重新配置环境。此外,NVIDIA Sync Model Launcher即将推出,可一键下载并启动模型,并自动配置OpenCode供浏览器内编码使用。
本地AI的典型应用场景
文章列举了三种工作流:一是全天候运行AI代理,用于代码审查、文档分析或多步任务,集群可提供更大容量以支持更长上下文或多个代理;二是在日常PC上运行语言或图像生成模型,由DGX Spark处理推理,释放PC资源;三是当单机任务超出内存时,通过双机集群无缝扩展,无需重新配置软件环境。这些场景强调隐私和本地化,减少对云端的依赖。
Q&A
NVIDIA DGX Spark 64GB 什么时候上市?有哪些厂商销售?起售价是多少?
NVIDIA DGX Spark 64GB 将于10月23日(周五)起由宏碁、华硕、戴尔、技嘉、惠普和微星发售,起售价为4999美元。
DGX Spark 64GB 的硬件配置和预装软件有哪些?
DGX Spark 64GB 搭载 GB10 Grace Blackwell 超级芯片、统一内存、NVIDIA ConnectX-7 网络,并预装 DGX OS 和完整的 NVIDIA AI 软件栈,包括 NVIDIA Agent Toolkit、CUDA-X AI 库、Nemotron 开源模型,以及 Ollama、vLLM、PyTorch with CUDA 等流行运行时。
DGX Spark 64GB 单机支持运行多大参数量的模型?
单台 DGX Spark 64GB 支持在设备上完全运行最高 1000 亿参数的模型,以及基于这些模型构建的智能体应用。
如何将两台 DGX Spark 64GB 集群?集群后有什么性能提升?
两台 DGX Spark 64GB 可通过 QSFP 线缆直连,使用 NVIDIA Sync Cluster Assistant 自动配置网络并池化内存至 128GB,支持最高 2000 亿参数模型,内存带宽翻倍,性能最高提升 1.7 倍(基于 Qwen 3.8 27B 测试)。
DGX Spark 64GB 有哪些典型开发用例?
典型用例包括:1)全天候运行 AI 智能体,如代码审查、文档分析或多步任务;2)在个人电脑上运行 AI 应用,由 DGX Spark 处理模型推理,释放 PC 资源;3)当工作负载增长时,通过集群扩展内存和计算能力,支持更大模型、更长上下文窗口或并发智能体请求。
NVIDIA Sync Model Launcher 是什么?它有什么功能?
NVIDIA Sync Model Launcher 是月底推出的功能,让运行本地 AI 变得像点击按钮一样简单。开发者可以下载并启动 Qwen3.8 27B 模型,NVIDIA Sync 会自动配置模型在连接设备上运行,并可从笔记本电脑访问。该启动器还会设置 OpenCode 使用该模型,方便开发者在浏览器中编码。