英伟达10月2日正式披露DGX Spark产品线更新,推出64GB内存版本的桌面AI计算机,起售价4999美元(约合33566元人民币),将于10月23日发售。宏碁、戴尔、华硕、技嘉、微星、H3C等OEM厂商将同步推出基于该平台的整机产品。官方此前发布的128GB FE版本同步更新定价,售价6950美元(约合46666元人民币)。
硬件层面,DGX Spark基于GB10 Grace-Blackwell超算芯片,采用统一内存架构打通CPU与GPU内存空间。本次新增的64GB版本整机总内存为64GB,系统预留约8GB,可供模型权重与KV缓存使用的内存空间约56GB。设备支持NVFP4量化格式,可部署Gemma4 26B、Qwen3.8-27B、Meta Muse Glimmer、Nemotron3.5 Lightning等主流开源大模型,模型加载完成后仍留有内存余量用于KV缓存,支撑长上下文推理任务。
该设备的核心能力之一是原生支持多机集群扩展。DGX Spark内置ConnectX-7高速网卡,搭配全新NVIDIA Sync工具套件,开发者无需深厚的网络运维知识即可搭建多节点集群。套件内置Cluster Assistant集群助手,可自动完成网络配置、设备校验和SSH环境部署,最多支持4台DGX Spark组网。官方实测数据显示,两台64GB DGX Spark组成集群运行Qwen3.8-27B模型,相比单台设备性能最高提升1.7倍,推理吞吐量显著提高。开发者还可从普通PC远程接入DGX Spark集群,对接VS Code、Cursor等主流IDE,远程监控整机状态,一键启动vLLM推理容器。
软件生态方面,DGX Spark完整搭载NVIDIA CUDA加速AI软件栈,深度适配vLLM、llama.cpp推理框架,并针对本地智能体工作流做专项优化,运行本地智能体推理最高可实现1.9倍速度提升。Perplexity已完成适配,推出针对DGX Spark优化的便携式计算机智能体,Laguna S2.1 118B大模型能够在硬件上完成本地部署运行。Nemotron系列模型、Gemma、Qwen、DeepSeek、Mistral、Stability.ai等主流开源模型与框架均已完成适配,开箱即可运行前沿模型。
性能测试显示,部署在DGX Spark上的Qwen3.8 27B模型,评测得分距离前沿闭源模型仅有10分差距,表明桌面硬件已具备运行高质量模型的能力。统一内存架构也获得行业开发者认可,Perplexity创始人Aravind Srinivas评价称,DGX Spark可以近乎打满GPU与内存负载,散热表现稳定,统一内存设计能够最大化每瓦功耗下的Token产出效率,适合7×24小时不间断运行本地智能体任务。
DGX Spark依旧面向专业开发者群体,4999美元起的定价决定其目标用户为AI研究人员、独立开发者及小型AI创业团队,并非面向普通消费用户。64GB版本的推出,相比128GB版本降低了采购门槛,使更多团队能够以更低成本体验本地集群能力。在AI推理需求持续向端侧和本地迁移的背景下,英伟达通过DGX Spark产品线的价格分层,正在将原本依赖云端算力的开发场景向桌面端延伸,这一策略能否推动本地AI开发范式的规模化落地,值得持续关注。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。