Since 1959

2026.10.06 (화)
2026.10.06 (화)
엔비디아, 최대 1,000억 파라미터 모델 로컬 실행하는 DGX 스파크 64GB 공개
2026-10-06 신윤오 기자, yoshin@elec4.co.kr

엔비디아 싱크 클러스터 어시스턴트로 DGX 스파크 연결... 메모리·성능 확장



엔비디아가 컴팩트한 개인용 AI 슈퍼컴퓨터인 엔비디아 DGX 스파크(NVIDIA DGX Spark)의 64GB 구성을 새롭게 공개했다.


로컬 AI는 토큰 단위로 더욱 유용해지고 있다. AI 에이전트가 실험 단계를 넘어 일상적인 개발 환경으로 자리 잡으면서, 더욱 강력해진 오픈 모델은 보다 많은 디바이스에 탑재 가능한 크기로 축소되고 있다. 동시에 로컬에서 실행할 수 있는 선택지도 점점 다양해지고 있다.


엔비디아 DGX 스파크는 10월 중 주요 제조사 파트너인 에이서(Acer), 에이수스(ASUS), 델(Dell), 기가바이트(Gigabyte), HP, MSI를 통해 64GB 통합 메모리 구성으로 출시된다. 개발자, 연구자, AI 애호가들은 새로운 64GB 구성을 통해 DGX OS와 엔비디아 AI 소프트웨어 스택을 바로 활용할 수 있다.



DGX 스파크 64GB는 디바이스에서 로컬 에이전트를 실행할 수 있어 클라우드에 의존하지 않고도 자체 처리가 가능하다. 또한 워크로드가 증가하면 엔비디아 싱크 클러스터 어시스턴트(Sync Cluster Assistant)를 통해 별도의 추가 설정 없이 두 대의 시스템을 하나의 클러스터로 연결할 수 있다.


DGX 스파크는 엔비디아 그레이스 블랙웰(Grace Blackwell) 컴퓨팅, 통합 메모리, 엔비디아 커넥트X-7(ConnectX-7) 네트워킹, 엔비디아 쿠다(CUDA) 가속 AI 소프트웨어 스택을 하나의 시스템에 결합했다. 이는 에이전트, 추론, 파인튜닝, 데이터 과학, 엣지 개발을 위한 완전한 로컬 AI 플랫폼이다.


컴팩트한 개인용 AI 슈퍼컴퓨터인 DGX 스파크는 모든 작업에서 클라우드 인스턴스를 사용할 필요 없이 개발자가 자신의 데이터로 모델을 실험할 수 있는 환경을 제공한다.


새로운 64GB 구성은 주요 제조사 파트너를 통해 제공되며, 도입 부담을 낮춘 가격대로 제공된다. 기존 128GB 모델과 동일한 GB10 그레이스 블랙웰 슈퍼칩(Grace Blackwell Superchip), DGX OS, 전체 엔비디아 AI 소프트웨어 스택을 그대로 제공하며, 최대 1,000억 파라미터 모델과 이를 기반으로 구축된 에이전트 애플리케이션을 디바이스에서 완전히 실행할 수 있다.


64GB 시스템 두 대를 클러스터로 연결하면 메모리와 성능을 함께 확장할 수 있다. 엔비디아가 자체적으로 진행한 큐원(Qwen) 3.8 27B 테스트에서 두 시스템을 클러스터로 구성했을 때 단일 시스템 대비 최대 1.7배의 성능을 기록했다. 또한 워크로드 요구에 따른 추가 확장도 가능하다.


DGX 스파크는 에이전트 개발에 필요한 환경을 갖췄다. 엔비디아 에이전트 툴킷(Agent Toolkit), 쿠다-X(CUDA-X) AI 라이브러리, 네모트론(Nemotron) 오픈 모델과 올라마(Ollama), vLLM, 쿠다 지원 파이토치(PyTorch) 등 주요 런타임을 기본 지원한다. 개발자는 전원을 켠 후 몇 분 만에 모델을 실행할 수 있다.


블렌더(Blender)는 이 플랫폼을 지원하는 최초의 주요 크리에이터 애플리케이션 중 하나로, 사전 구성된 설치 프로그램이 곧 제공될 예정이다.


엔비디아 싱크 클러스터 어시스턴트로 손쉽게 확장


개발자는 현재 프로젝트에 필요한 메모리로 시작해, 파이프라인이 확장됨에 따라 커진 워크로드에 맞춰 멀티 노드 클러스터로 원활하게 확장할 수 있다.


모든 DGX 스파크에는 엔비디아 커넥트X-7 NIC가 기본 탑재된다. 이와 함께 두 대의 시스템을 QSFP 케이블로 직접 연결해 메모리를 128GB로 확장하고, 최대 2,000억 파라미터 모델까지 지원 범위를 확장할 수 있다. 동시에 메모리 대역폭을 두 배로 늘리고 최대 1.7배의 성능을 활용할 수 있다.


엔비디아 싱크(Sync) 앱은 간편한 멀티 노드 클러스터 구성을 지원한다. 클러스터 어시스턴트 기능은 연결된 시스템을 감지하고, 디바이스 구성을 검증하며, 커넥트X-7 네트워크를 구성해 개발자가 인프라보다 작업 자체에 집중할 수 있도록 한다. 모든 노드는 동일한 엔비디아 소프트웨어 스택을 활용하므로, 한 대에서 두 대로 확장할 때 소프트웨어를 다시 구성할 필요가 없다.


한편 이달 말부터 엔비디아 싱크 모델 런처(Sync Model Launcher)를 통해 몇 번의 클릭만으로 로컬 AI를 간편하게 실행할 수 있다. 개발자는 단일 DGX 스파크 시스템 또는 클러스터에서 큐원 3.8 27B를 다운로드하고 실행할 수 있으며, 엔비디아 싱크가 연결된 디바이스에서 모델이 실행되도록 구성해 노트북에서도 해당 모델에 접근할 수 있다. 아울러 런처는 오픈코드(OpenCode)가 해당 모델을 사용할 수 있도록 설정해, 개발자가 브라우저에서 바로 코딩을 시작할 수 있도록 지원한다.


 

<저작권자(c)스마트앤컴퍼니. 무단전재-재배포금지>

100자평 쓰기