返回行业动态
算力与基础设施

英伟达上架 4999 美元 DGX Spark 64GB:本地跑 1000 亿参数,128GB 款涨价

英伟达 10 月 2 日新增 64GB 统一内存版 DGX Spark,起售价 4999 美元,10 月 23 日通过宏碁、华硕、戴尔、技嘉、惠普与微星发售,单机可本地运行最高 1000 亿参数模型。两台可通过 ConnectX-7 直连,将内存池化至 128GB、模型上限提升到 2000 亿参数。同期 128GB 版本 Founders Edition 定价上调至 6950 美元,反映内存供应紧张对本地算力成本的传导。

来源:NVIDIA 官方博客:NVIDIA DGX Spark 64GB Gives Developers More Ways to Build and Scale Local AI原标题:NVIDIA DGX Spark 64GB Gives Developers More Ways to Build and Scale Local AI查看原文
以深夜研发工作台上两台并排算力盒与发光连线表现的本地算力场景

图片来源:北京拓实科技原创(AI 生成封面)

发生了什么

英伟达 10 月 2 日宣布为 DGX Spark 桌面 AI 超算增加一档 64GB 统一内存配置,起售价 4999 美元,将于 10 月 23 日通过宏碁、华硕、戴尔、技嘉、惠普与微星六家 OEM 发售——英伟达官方渠道不直接销售该版本。新配置保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整的 CUDA 加速 AI 软件栈,并内置 ConnectX-7 网卡与双 QSFP 端口(200GbE)。

关键规格与扩展方式

  • 内存与带宽:64GB 统一内存,带宽 273GB/s;系统空载约占用 8GB,其余约 56GB 可供模型权重与 KV 缓存使用。
  • 可运行的模型:官方称单机最高支持 1000 亿参数模型,可在本地完成推理、微调与边缘开发。
  • 双机集群:两台 64GB 设备用 QSFP 线缆直连后,内存池化至 128GB、模型上限提升到 2000 亿参数、带宽翻倍;在英伟达自测的 Qwen3.8-27B(NVFP4)场景中,双机集群性能最高为单台 64GB 的 1.7 倍,且比单台 128GB 系统高约 70%。
  • 软件:出厂支持 Agent Toolkit、CUDA-X AI 库与 Nemotron 开放模型,以及 Ollama、vLLM、PyTorch with CUDA 等运行时;NVIDIA Sync 的 Cluster Assistant 可自动完成最多四台设备的组网配置,月底还将推出 Sync Model Launcher 一键下载并启动 Qwen3.8-27B。
  • 价格背景:128GB 版本 Founders Edition 的定价自 10 月 2 日起调整为 6950 美元,而该型号 2025 年 10 月首发价为 3999 美元,今年 2 月已上调至 4699 美元。

为什么值得关注

这条产品的意义不只是降门槛,更暴露了本地算力成本的另一面:据测算,两台 64GB 合计约 9998 美元(不含线缆与税),已经高于单台 128GB 机型;而 128GB 与 64GB 混组集群时,可用内存会被限制在 64GB。英伟达把64GB 版本的定位放在以更低单价进入本地智能体与长上下文推理,但内存供需才是定价的主导变量——存储厂商美光已警告,内存紧张将延续并在 2027 至 2028 年加剧。对需要在私有环境运行大模型的企业,采购决策正在从买哪块卡,转向显存单价与集群拓扑怎么算。换句话说,评估重点应该是每 GB 显存的价格、单机实际可承载的模型档位,以及双机集群后的有效吞吐,而不是只看整机标价。

不确定之处

上述性能倍数均来自英伟达自测,缺少第三方复现;64GB 版本能否在长上下文与并发智能体请求下保持可用吞吐,仍取决于具体模型与量化方案。需要注意的是,官方口径的 1000 亿参数上限建立在低比特量化之上,实际可用的上下文长度与并发数会随之下降;对于需要更高精度的微调任务,56GB 的可用内存未必够用。价格与供货也可能随内存市场波动继续调整,企业若按当前报价做预算,应预留上浮空间。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。