제품 개요 및 사양
NVIDIA DGX Spark는 Grace Blackwell GB10 슈퍼칩, 통합 메모리, ConnectX-7 네트워크 및 CUDA 가속 AI 소프트웨어 스택을 하나의 시스템에 결합한 개인용 AI 슈퍼컴퓨터입니다. 64GB 구성은 기존 128GB 모델과 동일한 DGX OS 및 전체 NVIDIA AI 소프트웨어 스택을 제공하며, 가격 접근성을 유지합니다.
가격 및 공급 정보
출시일은 2025년 10월 23일이며, 파트너사인 Acer, ASUS, Dell, Gigabyte, HP, MSI를 통해 구매할 수 있습니다. 가격은 $4,999부터 시작합니다.
| 구성 | 메모리 | 가격 (USD) |
|---|---|---|
| DGX Spark 64GB | 64GB 통합 메모리 | 4,999 |
| DGX Spark 128GB (참고) | 128GB 통합 메모리 | 미공개 |
성능 및 확장성
단일 DGX Spark 64GB 시스템은 최대 100억 파라미터 모델을 온디바이스에서 실행할 수 있습니다. 두 대를 NVIDIA Sync Cluster Assistant를 통해 연결하면 메모리가 128GB로 풀링되고, Qwen 3.8 27B 벤치마크에서 최대 1.7배의 성능 향상을 보여줍니다. 또한 클러스터링 시 최대 200억 파라미터 모델까지 지원되며, 메모리 대역폭은 200 GbE ConnectX-7을 통해 제공됩니다.
| Single | 1.0 |
| Clustered | 1.7 |
소프트웨어 스택 및 지원 도구
DGX Spark는 DGX OS와 함께 NVIDIA AI 소프트웨어 스택을 기본 제공합니다. 지원되는 런타임에는 Ollama, vLLM, PyTorch (CUDA), Nemotron 오픈 모델, NVIDIA Agent Toolkit 등이 포함됩니다. 또한 NVIDIA Sync Model Launcher를 통해 Qwen3.8 27B 모델을 한 번의 클릭으로 실행하고, OpenCode를 연동하여 브라우저에서 코딩을 시작할 수 있습니다.
\"Developers can go from power-on to running models in minutes.\"
활용 사례 및 워크플로
- 연중무휴 AI 에이전트 실행: DGX Spark에 코딩 또는 연구 에이전트를 상시 가동시켜 코드 리뷰, 문서 분석, 다단계 작업을 처리합니다.
- 개인 PC와의 협업: DGX Spark에서 언어 또는 이미지 생성 모델을 추론하고, 노트북이나 데스크톱에서는 에이전트 또는 창작 애플리케이션을 실행하여 리소스를 분리합니다.
- 작업 규모에 따른 스케일링: 단일 작업이 하나의 유닛을 초과할 경우, 두 대를 클러스터링하여 메모리와 컴퓨팅을 확장하며, 소프트웨어 환경을 재구성하지 않고 워크로드를 확장합니다.
- 두 대의 DGX Spark 연결
- ConnectX-7 포트를 QSFP 케이블로 연결
- NVIDIA Sync Cluster Assistant 실행
- 네트워크 구성 및 검증
- 워크로드 자동 라우팅
시작 방법
1. 파트너사 웹사이트에서 DGX Spark 64GB를 주문하고 수령합니다. 2. 전원을 켜고 DGX OS가 부팅되면, 선호하는 추론 프레임워크(llama.cpp, Ollama, vLLM 또는 LM Studio)를 다운로드합니다. 3. 워크플로에 맞는 로컬 모델(예: Qwen3.8 27B)를 다운로드합니다. 4. 두 대를 클러스터링하려면 ConnectX-7 포트를 QSFP 케이블로 연결하고, NVIDIA Sync Cluster Assistant를 실행하여 네트워크를 자동 구성합니다. 5. NVIDIA Sync Model Launcher를 통해 모델을 실행하고, 브라우저에서 OpenCode를 이용해 개발을 시작합니다.