X

엔비디아, DGX 스파크 64GB 공개…로컬 AI 확장 지원

이 기사 AI가 핵심만 딱!
애니메이션 이미지
한광범 기자I 2026.10.06 09:59:28

Google 검색에서 이데일리 기사를 더 자주 볼 수 있습니다.

최대 1000억 파라미터 모델 로컬 실행
2대 연결시 128GB·2000억 파라미터까지 확장

엔비디아, DGX 스파크 64GB 공개…로컬 AI 확장 지원
[이데일리 한광범 기자] 엔비디아가 개인용 AI 슈퍼컴퓨터 ‘DGX 스파크(NVIDIA DGX Spark)’의 64GB 통합 메모리 구성을 새롭게 공개했다. 클라우드에 의존하지 않고도 로컬에서 AI 에이전트와 대규모 모델을 실행하고, 필요에 따라 여러 대를 연결해 성능을 확장할 수 있도록 한 것이 특징이다.

엔비디아는 DGX 스파크 64GB를 오는 23일부터 에이서, 에이수스, 델, 기가바이트, HP, MSI 등 주요 제조사 파트너를 통해 출시한다고 6일 밝혔다. 가격은 4999달러부터다.

새로운 64GB 모델은 기존 128GB 제품과 동일한 GB10 그레이스 블랙웰 슈퍼칩, DGX OS, 엔비디아 AI 소프트웨어 스택을 제공한다. 최대 1000억 파라미터 규모의 모델과 이를 기반으로 한 에이전트 애플리케이션을 디바이스에서 직접 실행할 수 있다.

DGX 스파크는 그레이스 블랙웰 컴퓨팅과 통합 메모리, 커넥트X-7 네트워킹, CUDA 기반 AI 소프트웨어 스택을 하나의 시스템에 결합했다. 에이전트 개발과 추론, 파인튜닝, 데이터 과학, 엣지 개발 등을 로컬 환경에서 수행할 수 있도록 설계됐다.

개발자는 클라우드 인스턴스를 별도로 사용하지 않고 자신의 데이터로 모델을 실험할 수 있다. 엔비디아 에이전트 툴킷과 CUDA-X AI 라이브러리, 네모트론 오픈 모델을 비롯해 올라마, vLLM, CUDA 지원 파이토치 등 주요 런타임도 지원한다.

확장 기능도 강화했다. DGX 스파크 64GB 두 대를 엔비디아 싱크 클러스터 어시스턴트로 연결하면 통합 메모리를 128GB로 늘리고 최대 2000억 파라미터 모델까지 지원할 수 있다. 200GbE 기반으로 두 시스템을 연결해 메모리 대역폭도 확대할 수 있다.

엔비디아가 자체 진행한 큐원(Qwen) 3.8 27B 테스트에서는 두 시스템을 클러스터로 구성했을 때 단일 시스템 대비 최대 1.7배 성능을 기록했다.

클러스터 구성 과정도 단순화했다. 엔비디아 싱크 앱은 연결된 시스템을 자동 감지하고 디바이스 구성을 검증한 뒤 커넥트X-7 네트워크를 설정한다. 모든 노드가 동일한 소프트웨어 스택을 사용하기 때문에 한 대에서 두 대로 확장할 때 별도의 소프트웨어 재구성이 필요하지 않다.

이달 말부터는 ‘엔비디아 싱크 모델 런처’도 제공한다. 개발자는 몇 번의 클릭만으로 큐원 3.8 27B 등 로컬 모델을 단일 DGX 스파크나 클러스터에서 내려받아 실행할 수 있다. 연결된 노트북에서도 해당 모델에 접근할 수 있도록 지원한다.

DGX 스파크는 24시간 작동하는 코딩·연구용 AI 에이전트, 일반 PC와 연동한 언어·이미지 생성 모델 구동, 워크로드 증가에 따른 멀티노드 확장 등 다양한 로컬 AI 환경에 활용할 수 있다.

이 기사 AI가 핵심만 딱!
애니메이션 이미지

주요 뉴스

ⓒ종합 경제정보 미디어 이데일리 - 상업적 무단전재 & 재배포 금지