커뮤니티 입장하기

DGX 스파크(DGX Spark) 이해하기, 무엇이고 누구에게 맞는지

DGX 스파크는 엔비디아가 2025년 10월에 내놓은 손바닥 크기의 AI 개발용 컴퓨터로, GB10 그레이스 블랙웰 슈퍼칩에 통합 메모리 128GB를 얹고 리눅스 기반 DGX OS로 돌아갑니다. 큰 모델을 한 대에 올려 종일 켜 두는 용도에 맞고, 답이 빠르게 나오는 장비는 아닙니다.

같은 말:DGX 스파크DGX SparkDGX 스파크 가격GB10엔비디아 소형 AI 컴퓨터

새로 올라온 개념이에요. 먼저 읽어 보고 퀴즈도 풀어 보세요
Share
목차
  1. 🤔 손바닥 크기 컴퓨터에 128GB가 들어 있다는 말을 들었을 때
  2. 🔑 DGX 스파크의 정의
  3. 📋 공식 사양
  4. 🚰 대역폭 273GB/s가 뜻하는 것
  5. 🔌 두 대를 묶었을 때 달라지는 것
  6. 🎯 맞는 용도와 맞지 않는 용도
  7. ⚠️ 자주 하는 실수
  8. ❓ 자주 묻는 질문
  9. 📋 3줄 요약
  10. 참고 자료

🤔 손바닥 크기 컴퓨터에 128GB가 들어 있다는 말을 들었을 때

로컬에서 큰 언어 모델을 돌리려는 분들 사이에서 DGX 스파크는 자주 나오는 이름입니다. 손바닥 크기 상자에 128GB 메모리가 들어 있고 100B급 모델이 한 대에 올라간다는데, 정작 써 본 사람의 평은 느리다는 쪽과 시간이 갈수록 나아졌다는 쪽으로 나뉩니다.

두 평가가 같은 장비를 두고 나오는 이유는 이 장비가 잘하는 일과 못하는 일이 뚜렷하기 때문입니다. DGX 스파크가 무엇이고 공식 사양이 어떻게 되는지, 어떤 용도에 맞고 어떤 용도에는 맞지 않는지를 2026년 9월 28일 기준으로 정리했습니다.

🔑 DGX 스파크의 정의

DGX 스파크(DGX Spark)는 엔비디아가 2025년 10월에 내놓은 손바닥 크기의 AI 개발용 컴퓨터로, GB10 그레이스 블랙웰 슈퍼칩에 통합 메모리 128GB를 얹고 리눅스 기반 DGX OS로 돌아갑니다.

이름부터 나누겠습니다. DGX는 엔비디아가 AI 개발용으로 파는 완제품 컴퓨터 계열이고, RTX는 게이밍과 워크스테이션용 그래픽카드 계열입니다. DGX 스파크는 DGX 계열 가운데 가장 작은 제품이라 그래픽카드를 꽂는 방식이 아니라 CPU와 GPU가 한 칩에 묶여 메모리 하나를 나눠 씁니다. 이 구조가 무엇을 뜻하는지는 하드웨어 기초에서 다뤘습니다.

📋 공식 사양

엔비디아 공식 제품 페이지와 보도자료에 적힌 값입니다.

항목값
칩GB10 그레이스 블랙웰 슈퍼칩
CPU20코어 Arm (Cortex-X925 10개, Cortex-A725 10개)
GPU블랙웰 아키텍처, CUDA 코어 6,144개
AI 연산FP4 기준 최대 1페타플롭
통합 메모리128GB LPDDR5x
메모리 대역폭273GB/s
저장 장치4TB NVMe
네트워크ConnectX-7, QSFP 포트 2개, 포트당 최대 200Gb/s, 10GbE 이더넷 1개
운영체제DGX OS (우분투 기반 리눅스)
크기와 무게150mm × 150mm × 50.5mm, 1.2kg
전력어댑터 240W, 칩 140W
한 대에서 다루는 모델추론 최대 2,000억 파라미터, 미세조정 최대 700억 파라미터 (엔비디아 표기)
출시2025년 10월 15일 주문 시작

가격은 공식 페이지에 적혀 있지 않습니다. 출시 때 3,999달러였고, 2026년 2월 엔비디아 개발자 포럼 공지로 파운더스 에디션이 4,699달러로 올랐습니다. 메모리 부품값 상승이 이유로 보도됐습니다. 국내 유통가는 2026년 9월 가격비교 등재가 기준 939만 원 안팎이고, 구매 시점의 가격은 직접 확인해야 합니다.

🚰 대역폭 273GB/s가 뜻하는 것

사양표에서 이 장비의 성격을 정하는 값은 메모리 용량과 대역폭 둘입니다. 128GB는 소비자용 그래픽카드 가운데 큰 편인 RTX 5090의 32GB보다 네 배 크지만, 대역폭 273GB/s는 RTX 5090의 1,792GB/s보다 6분의 1 수준입니다.

물탱크와 수도관에 빗대면 탱크는 큰데 관이 가는 장비입니다. 큰 모델을 담을 수는 있는데, 토큰을 하나씩 만들 때마다 가중치를 그 가는 관으로 실어 나르므로 답이 천천히 나옵니다. 4비트로 압축한 모델을 기준으로 초당 토큰 상한을 계산하면 7B는 78, 30B는 18, 70B는 8 안팎이고 실측은 그보다 낮습니다. 70B 밀집 모델이 쓸 만한 속도로 돌지 않는다는 평은 여기서 나옵니다.

그런데 2026년 들어 이 평가가 달라졌습니다. 그해 공개된 큰 모델 상당수가 MoE(전문가 혼합) 구조라 토큰마다 읽는 양이 총 파라미터보다 훨씬 작습니다. llama.cpp 저장소의 공식 벤치 기록에서 DGX 스파크 한 대로 총 117B인 MoE 모델이 초당 58.7토큰을 냈는데, 총 7.6B인 밀집 모델의 29.4토큰보다 두 배 빠릅니다. 관은 그대로인데 보낼 물이 줄어든 것입니다. 엔비디아 개발자 포럼에는 27B 밀집 모델을 4비트로 돌려 초당 34토큰 안팎이 나왔다는 사용자 보고도 있는데, 공식 벤치마크가 아니므로 참고 수준으로 봅니다.

🔌 두 대를 묶었을 때 달라지는 것

뒷면의 QSFP 포트 두 개가 이 장비를 그래픽카드나 RTX 스파크와 나누는 부분입니다. 엔비디아 클러스터 문서에 따르면 케이블로 직접 이을 수 있는 것은 세 대까지이고, 네 대를 묶으려면 스위치가 필요합니다. 케이블로 본체를 이으면 모델 하나를 여러 대의 메모리에 나눠 올릴 수 있습니다.

다만 두 대의 의미는 속도보다 크기에 가깝습니다. 한 실사용자가 엔비디아 개발자 포럼에 올린 같은 조건의 기록입니다.

모델한 대두 대
GPT-OSS-120B초당 36토큰초당 55토큰
Qwen3-30B-A3B NVFP4초당 64토큰초당 75토큰
Qwen3-VL-235B-A22B NVFP4실행 불가초당 21토큰

이미 한 대에서 돌아가던 모델은 1.2배에서 1.7배 빨라지는 데 그쳤고, 다른 사용자의 llama.cpp 측정에서는 두 대가 오히려 느려진 기록도 있습니다. 두 대 사이를 잇는 200Gb/s는 초당 약 25GB라 장비 안의 273GB/s보다 열 배 넘게 가늘고, 토큰마다 중간 결과가 그 배관을 건너야 하기 때문입니다. 표 마지막 줄처럼 한 대로는 아예 실행되지 않던 모델을 올리려고 둘째 장비를 두는 것이고, 커뮤니티에서는 큰 모델을 올리려면 묶고 처리량을 늘리려면 같은 구성을 하나 더 둔다고 정리합니다. 명목 256GB 가운데 실제로 쓸 수 있었던 양이 약 170GB였다는 측정도 있어, 두 대를 사면 용량이 정확히 두 배가 된다고 보지 않는 편이 안전합니다.

🎯 맞는 용도와 맞지 않는 용도

2026년 9월 기준으로 정리하면 이렇습니다.

맞는 용도이유
100B급 MoE 모델을 한 대에서 상시 실행128GB에 올라가고 활성 파라미터가 작아 속도 손해가 덜함
24시간 켜 두는 실행체추론 상주 전력이 50W 안팎이라는 실측이 있고 어댑터도 240W라 그래픽카드 구성보다 전기와 소음이 적음
70B 이하 모델의 미세조정엔비디아가 공식으로 안내하는 범위
300B 이상 모델을 로컬에서 실행두 대 이상을 묶는 공식 경로가 있는 쪽
맞지 않는 용도이유
짧은 대화를 빠르게 주고받는 작업대역폭이 낮아 30B 이하 모델은 RTX 5090 쪽이 훨씬 빠름
게임이나 영상 편집 겸용리눅스 전용이고 게임용 장비가 아님
윈도우 전용 업무 도구와 함께 쓰기DGX OS라 윈도우 프로그램이 돌아가지 않음
사용량이 적은 개인128GB에 올라가는 크기의 모델은 API 단가가 낮아 한 달 십수 달러로도 쓸 수 있음

사지 말라는 쪽의 근거도 함께 적어 둡니다. GB10용 소프트웨어 지원이 출시 뒤 몇 달에 걸쳐 고르지 않았고, 값이 이미 17.5% 올랐으며, 국내 수리 대기가 5주를 넘겼다는 사용자 기록이 있습니다. 한 대만 써 본 사람과 두 대를 운용하는 사람의 평이 다르다는 점도 함께 볼 만합니다. 장비별 가격과 올릴 수 있는 모델 크기는 DGX 스파크와 RTX 5090 비교에, 다음 모델을 기다릴지의 판단은 DGX 스파크 다음 모델 정리에 있습니다.

⚠️ 자주 하는 실수

  • 128GB를 다 쓸 수 있다고 봅니다: 사용자 측정에서 GPU 배정량은 제조사에 따라 119GB에서 122GB 사이였습니다. 엔비디아가 확인한 값은 아니지만 사양표 그대로는 아닙니다.
  • 두 대면 두 배 빠를 것이라고 봅니다: 속도 이득은 1.2배에서 1.7배이고, 둘째 장비는 한 대에 안 올라가던 모델을 위한 것입니다.
  • RTX 스파크를 후속 모델로 봅니다: 같은 세대의 칩을 윈도우 시장에 낸 자매 제품이고, QSFP 포트가 없어 묶을 수 없습니다.
  • 가격을 출시가로 계산합니다: 2026년 2월에 공식가가 올랐고 국내 유통가는 따로 움직입니다. 구매 시점에 확인합니다.

❓ 자주 묻는 질문

DGX 스파크는 개인이 살 수 있나요?

살 수 있습니다. 에이수스, 델, HP, 레노버, MSI 같은 제조사 판과 엔비디아 파운더스 에디션이 있고 국내 유통도 됩니다. 다만 2026년 9월 기준으로 엔비디아 스토어에서 주문이 막혀 있는 것으로 확인되고, 중고 낙찰가가 출시가보다 높게 보고되는 상황이라 구매 경로와 가격은 시점마다 다릅니다.

리눅스를 모르는데 쓸 수 있나요?

기본 운영체제가 우분투 기반이라 터미널 명령에 어느 정도 익숙해야 합니다. 올라마나 llama.cpp 같은 실행 도구는 리눅스에서 명령 몇 줄로 설치되고, 밖에서 붙어 쓰는 SSH와 tmux 구성도 리눅스에 그대로 맞습니다. 윈도우 화면이 익숙한 분이라면 2026년 10월 출시 예정인 RTX 스파크 쪽이 맞을 수 있습니다.

API를 쓰는 편이 싸지 않나요?

사용량이 적으면 API가 훨씬 쌉니다. 128GB에 올라가는 오픈 모델은 API 단가가 낮아, 하루 입력 100만 토큰 정도로는 한 달에 십수 달러로 계산됩니다. 장비 쪽이 맞는 경우는 자료를 밖으로 내보내기 어렵거나 토큰 요금 없이 종일 돌려야 할 때입니다. 939만 원을 3년에 나누면 월 26만 원이고 여기에 전기료가 월 9,000원대 붙는데, 그만한 구독을 이미 쓰고 있다면 비슷한 셈이 됩니다.

DGX 스테이션과는 무엇이 다른가요?

같은 DGX 계열의 타워형 완제품이고 GPU 메모리 252GB에 CPU 메모리 496GB를 더해 748GB를 갖췄습니다. 700B대 모델을 한 대에 올릴 수 있지만 파트너 견적이 9만 달러대라는 보도가 있고 시스템 전력이 1,600W라 개인 용도로 보기는 어렵습니다. 개인이나 소규모 팀은 DGX 스파크를 여러 대 묶는 쪽이 현실적입니다.

📋 3줄 요약

  1. DGX 스파크는 엔비디아가 2025년 10월 15일 내놓은 가로세로 150mm 소형 AI 컴퓨터로, 통합 메모리 128GB와 FP4 1페타플롭 연산에 리눅스 기반 DGX OS를 씁니다.

  2. 메모리 대역폭이 273GB/s라 RTX 5090의 6분의 1 수준이므로 큰 모델을 한 대에 올리는 데 맞고 짧은 대화를 빠르게 주고받는 데는 그래픽카드가 앞섭니다.

  3. 출시가 3,999달러에서 2026년 2월 4,699달러로 올랐고, 두 대를 200Gb/s 포트로 묶으면 한 대에 올라가지 않던 모델을 올릴 수 있지만 이미 돌아가던 모델의 속도는 1.2배에서 1.7배 오르는 데 그칩니다.

참고 자료

Share

제대로 이해했는지 한 문제로 확인해 볼까요?

답을 고르면 바로 풀이가 나와요.

DGX 스파크 두 대를 QSFP 케이블로 묶는 이유로 가장 맞는 것은 무엇일까요?

5개념 / 클래스RTX 스파크(RTX Spark) 이해하기, 확인된 사양과 정황 구분