
엔비디아가 64GB 통합 메모리를 장착한 로컬 AI 플랫폼 ‘DGX Spark(DGX 스파크)’ 신규 구성을 선보였다.
에이전트 실행과 추론, 미세조정(Fine-tuning), 데이터 과학, 엣지 개발을 겨냥해 설계된 데스크톱 AI 슈퍼컴퓨터다. 에이서(Acer), 에이수스(ASUS), 델(Dell), 기가바이트(Gigabyte), HP, MSI 등 글로벌 주요 제조 파트너사를 통해 출격한다. 기기 내부에는 엔비디아 DGX OS와 AI 소프트웨어 스택이 기본 탑재된다.
외부 클라우드 연결 없이 독립 기기에서 자율형 AI 에이전트를 실시간 구동할 수 있다. 더 큰 규모의 워크로드가 요구될 경우 '엔비디아 싱크 클러스터 어시스턴트(NVIDIA Sync Cluster Assistant)'를 통해 시스템 두 대를 하나로 묶어 확장 처리하는 방식을 지원한다.
이번 64GB 모델은 기존 128GB 모델에 들어갔던 GB10 그레이스 블랙웰(Grace Blackwell) 슈퍼칩과 커넥트X-7(ConnectX-7) 네트워킹 인프라를 동일하게 공유한다. 단일 시스템 환경에서는 최대 1000억(100B) 파라미터 규모의 대형언어모델(LLM)과 이를 기반으로 구동되는 에이전트 애플리케이션을 온전히 로컬 단에서 돌릴 수 있다.
시스템 확장은 직관적이다. 두 대의 기기를 QSFP 케이블로 직접 연결하면 통합 메모리가 128GB로 확장되면서 최대 2000억(200B) 파라미터 수준의 모델까지 커버할 수 있다. 동시에 메모리 대역폭도 2배로 넓어진다. 엔비디아 측이 Qwen 3.8 27B 모델로 자체 측정한 결과에 따르면, 64GB 시스템 두 대를 클러스터로 구축했을 때 단일 기기 대비 처리 성능이 최대 1.7배까지 늘어난 것으로 나타났다.
장비 간 연동 작업은 전용 소프트웨어가 알아서 처리한다. 엔비디아 싱크(NVIDIA Sync) 앱의 클러스터 어시스턴트는 연결된 장비를 자동으로 감지하고 시스템 구성을 검증한 뒤 커넥트X-7 네트워크 환경을 설정한다. 이달 말 공개될 '엔비디아 싱크 모델 런처(NVIDIA Sync Model Launcher)'를 활용하면 Qwen 3.8 27B 같은 모델을 단일 디바이스나 클러스터 장비에 곧바로 다운로드해 실행할 수 있다. 연결 기기 사양에 맞춰 모델 파라미터를 맞춤 재구성하고 개발자 노트북에서 원격으로 접근할 수 있도록 돕는다. 코딩 개발 도구인 오픈코드(OpenCode)와의 연동 환경도 함께 다듬어진다.
소프트웨어 생태계 지원 범위도 넓다. 엔비디아 에이전트 툴킷(NVIDIA Agent Toolkit)을 비롯해 CUDA-X AI 라이브러리, 네모트론(Nemotron) 오픈 모델, 올라마(Ollama), vLLM, 파이토치(PyTorch with CUDA) 등 현장에서 자주 쓰는 프레임워크가 호환된다.
엔비디아 64GB DGX Spark는 오는 10월 23일부터 파트너사 채널을 통해 4999달러부터 정식 판매를 시작한다. 200GbE 패브릭 기반의 두 대 연결 클러스터링 기능과 함께, 3D 그래픽 및 랜더링 작업을 위한 블렌더(Blender) 전용 설치 프로그램도 향후 제공될 예정이다.





