NVIDIA DGX Spark

桌面级个人 AI 超级计算机

NVIDIA Grace Blackwell AI Computing at Your Desk

紧凑尺寸 · 1 PFLOP AI 算力 · 128GB 统一内存 · NVIDIA 完整 AI 软件栈

NVIDIA DGX Spark 是面向 AI 开发者、科研人员、数据科学家及工程团队打造的桌面级 AI 超级计算平台。

系统基于 NVIDIA GB10 Grace Blackwell Superchip,将 Blackwell GPU、20 核 Arm CPU、高速统一内存与 NVIDIA AI 软件生态集成于紧凑型设备中,可在本地完成大语言模型推理、模型微调、Agent 开发、生成式 AI、机器人及边缘 AI 等工作负载。

无需部署大型 GPU 服务器,即可在桌面获得完整的 NVIDIA Grace Blackwell AI 开发环境。


核心优势

1 PFLOP AI Computing Performance

采用 NVIDIA Blackwell GPU 架构与第五代 Tensor Core,在 FP4 精度下提供最高:

1 PFLOP AI Performance

适用于:

  • Large Language Models
  • Generative AI
  • AI Agents
  • Multimodal AI
  • Vision AI
  • Robotics
  • Scientific AI
  • AI-RAN / 6G Research

NVIDIA GB10 Grace Blackwell Superchip

DGX Spark 搭载 NVIDIA GB10 Grace Blackwell Superchip,将 CPU 与 GPU 集成于统一计算架构。

CPU

20-Core Arm CPU

  • 10 × Arm Cortex-X925
  • 10 × Arm Cortex-A725

GPU

NVIDIA Blackwell Architecture

  • Blackwell Generation CUDA Cores
  • 5th Generation Tensor Cores
  • 4th Generation RT Cores
  • 支持 FP4 AI Computing

CPU、GPU 与统一内存紧密耦合,为 AI 模型开发、推理和数据处理提供高效的数据访问能力。


128GB Coherent Unified Memory

让大型 AI 模型直接运行在桌面

DGX Spark 配备:

128GB LPDDR5X Coherent Unified System Memory

内存带宽:

273 GB/s

统一内存架构使 CPU 和 GPU 可以访问同一内存空间,减少传统独立 CPU/GPU 系统中的数据复制过程。

这使 DGX Spark 能够支持远超普通桌面 GPU 显存容量的大型模型。

模型能力

模型微调

支持最高约:

70 Billion Parameters

模型微调工作负载。

模型推理

支持最高约:

200 Billion Parameters

AI 模型的本地测试、验证和推理。


双机扩展至 405B 参数模型

DGX Spark 集成高性能:

NVIDIA ConnectX-7 Networking

网络能力最高:

200 Gbps

通过高速互联,可连接 两台 DGX Spark 组成桌面 AI 计算集群。

双机系统可用于处理最高约:

405 Billion Parameters

的大型 AI 模型。

从单机桌面开发环境进一步扩展到多节点 AI Computing。


4TB 高速本地存储

内置:

4TB NVMe M.2 SSD

支持 Self-Encrypting Storage。

可用于存储:

  • Large Language Models
  • Model Weights
  • Training Datasets
  • Docker / NGC Containers
  • Vector Databases
  • AI Development Environments
  • Simulation Data
  • Digital Twin Data

无需依赖外部存储即可构建完整的本地 AI 开发环境。


NVIDIA AI Software Stack

DGX Spark 不仅是一台 AI 计算设备,更是一套完整的 NVIDIA AI 开发平台。

系统预装并支持 NVIDIA AI 软件生态,可用于快速构建从 Prototype 到 Deployment 的完整开发环境。

包括:

  • NVIDIA DGX OS
  • NVIDIA CUDA
  • CUDA-X Libraries
  • NVIDIA NIM
  • NVIDIA AI Enterprise
  • PyTorch
  • Jupyter
  • Docker
  • NVIDIA Container Toolkit
  • NVIDIA NGC
  • TensorRT
  • RAPIDS
  • NVIDIA NeMo
  • NVIDIA Isaac
  • NVIDIA Metropolis
  • NVIDIA Holoscan

开发人员可以在 DGX Spark 上完成模型开发,再将工作负载迁移至 NVIDIA GPU 数据中心、DGX Cloud 或其他 NVIDIA 加速基础设施。


典型 AI 工作负载

Large Language Models

在本地运行和验证大型语言模型。

适用于:

  • LLM Inference
  • RAG
  • Embedding
  • Vector Database
  • AI Assistant
  • Knowledge Base
  • Local Private AI

AI Agent

DGX Spark 特别适合构建本地 Autonomous AI Agent。

可用于:

  • Autonomous Agents
  • Coding Agents
  • Research Agents
  • Enterprise AI Assistants
  • Multi-Agent Systems
  • Tool Calling
  • Private AI Agent

本地运行模型可减少对云端 Token Generation 资源的依赖,并更方便构建私有 AI 环境。


Model Fine-Tuning

利用 128GB 统一内存,可在桌面完成大型模型的:

  • Fine-Tuning
  • LoRA
  • QLoRA
  • Model Adaptation
  • Domain-Specific AI
  • Instruction Tuning

支持最高约 70B 参数级模型微调


AI Inference

Blackwell Tensor Core 与 FP4 Computing 为大型模型推理提供高计算密度。

适用于:

  • LLM
  • VLM
  • Multimodal Model
  • Speech Model
  • Vision Model
  • Generative AI

单机支持最高约 200B 参数模型的测试、验证和推理。


AI-RAN / 5G / 6G Research

对于通信、AI-RAN 与下一代无线网络研究,DGX Spark 可作为紧凑型 GPU AI Computing Node。

典型研究方向包括:

AI for RAN

  • Neural Receiver
  • Channel Estimation
  • CSI Prediction
  • Beam Management
  • Traffic Prediction
  • RAN Optimization
  • Reinforcement Learning
  • AI-based Scheduling

RAN for AI

利用无线网络连接边缘 AI 节点,实现:

  • Distributed AI
  • Edge Inference
  • Multi-Agent Collaboration
  • AI Service Delivery
  • Edge Computing Research

AI and RAN

探索 GPU Computing 与无线通信系统融合,包括:

  • AI-RAN
  • 5G Advanced
  • 6G
  • Open RAN
  • Digital Twin
  • Wireless AI

NVIDIA Sionna Research Platform

DGX Spark 可作为 NVIDIA Sionna 相关无线 AI 研究的本地计算平台。

适用于:

  • NVIDIA Sionna
  • Sionna RT
  • Sionna Research Kit
  • Neural Receiver
  • Channel Modeling
  • Link-Level Simulation
  • Wireless Digital Twin
  • Ray Tracing
  • AI-native PHY Research

研究人员可以将无线通信算法、AI 模型与 GPU 加速计算结合,构建面向 5G Advanced 与 6G 的研究环境。


Robotics & Edge AI

DGX Spark 同样适用于机器人与边缘 AI 开发。

支持 NVIDIA:

Isaac

用于机器人 AI 与自主系统开发。

Metropolis

用于视觉 AI 与智能空间应用。

Holoscan

用于实时传感器数据和高性能边缘 AI 工作负载。

典型场景包括:

  • Robotics
  • Autonomous Systems
  • Computer Vision
  • Smart City
  • Industrial AI
  • Edge AI
  • Digital Twin

高速网络与扩展能力

DGX Spark 提供丰富的高速接口。

Interface Specification
High-Speed NIC NVIDIA ConnectX-7
ConnectX Networking Up to 200 Gbps
Ethernet 10 GbE RJ45
USB 4 × USB Type-C
Wireless Wi-Fi 7
Bluetooth Bluetooth 5.4
Display HDMI 2.1a
DisplayPort Up to 3 × DP over USB-C

可连接:

  • High-Speed Storage
  • AI Workstations
  • Ethernet Switches
  • Development Boards
  • Cameras
  • Sensors
  • SDR
  • Robotics Platforms
  • Additional DGX Spark Nodes

技术规格

项目 NVIDIA DGX Spark
Processor NVIDIA GB10 Grace Blackwell Superchip
Architecture NVIDIA Grace Blackwell
GPU NVIDIA Blackwell Architecture
CPU 20-Core Arm
CPU Configuration 10 × Cortex-X925 + 10 × Cortex-A725
CUDA Cores Blackwell Generation
Tensor Cores 5th Generation
RT Cores 4th Generation
AI Performance Up to 1 PFLOP FP4
System Memory 128GB LPDDR5X
Memory Architecture Coherent Unified System Memory
Memory Interface 256-bit
Memory Bandwidth 273 GB/s
Storage 4TB NVMe M.2
High-Speed NIC NVIDIA ConnectX-7
Network Performance Up to 200 Gbps
Ethernet 10 GbE RJ45
Wi-Fi Wi-Fi 7
Bluetooth Bluetooth 5.4
USB 4 × USB Type-C
Display HDMI 2.1a / DisplayPort over USB-C
Power Supply 240W
GB10 TDP 140W
Operating System NVIDIA DGX OS
Dimensions 150 × 150 × 50.5 mm
Weight Approx. 1.2 kg

一台设备,完整 AI 开发链路

AI Model
   │
   ▼
Model Development
   │
   ▼
Fine-Tuning
   │
   ▼
Local Inference
   │
   ▼
AI Agent / RAG / Multimodal AI
   │
   ▼
Application Validation
   │
   ▼
DGX Cloud / Data Center / Edge Deployment

DGX Spark 将 NVIDIA 数据中心 AI 技术带到桌面,使 AI 开发者能够在同一架构体系下完成从本地研发到大型 GPU 基础设施部署的完整工作流。


适用客户

高校与科研机构

适用于:

  • 人工智能实验室
  • 5G / 6G 实验室
  • 通信工程实验室
  • 机器人实验室
  • 自动驾驶实验室
  • 计算机视觉实验室
  • 大模型研究团队

企业研发

适用于:

  • AI Algorithm Teams
  • Enterprise Private AI
  • AI Agent Development
  • Intelligent Manufacturing
  • Telecom R&D
  • Edge AI
  • Digital Twin
  • Robotics

AI 开发者

在个人桌面即可获得 Grace Blackwell AI Computing Platform,用于快速开发、验证和部署下一代 AI 应用。


NVIDIA DGX Spark

Supercomputing AI Performance.

Right From Your Desktop.

GB10 Grace Blackwell Superchip

Up to 1 PFLOP FP4 AI Performance

128GB Unified Memory

4TB NVMe Storage

200Gbps ConnectX-7 Networking

NVIDIA Full-Stack AI Software Platform

从大型语言模型到 AI Agent,从生成式 AI 到机器人,从无线 AI 到 6G Research——

将 NVIDIA Grace Blackwell AI Computing 带到每一张研发工作台。


产品说明

产品规格及软件功能可能随 NVIDIA 官方版本更新而调整,最终配置以实际交付产品及 NVIDIA 官方技术文档为准。

在这里插入图片描述

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐