AI & Tech

RTX 스파크(RTX Spark) 사양 정리: 로컬 AI 에이전트를 집 컴퓨터에서 돌리는 조건

RTX 스파크는 엔비디아가 2026년 10월 출시를 예고한 윈도우 PC용 슈퍼칩으로, 20코어 Grace CPU와 블랙웰 RTX GPU에 통합 메모리를 최대 128GB까지 얹었습니다. 로컬 AI 에이전트를 집 컴퓨터에서 돌리는 조건을 맥 스튜디오, RTX 5090과 비교해 정리했습니다.

2026. 9. 7.23
Share
RTX 스파크(RTX Spark) 사양 정리: 로컬 AI 에이전트를 집 컴퓨터에서 돌리는 조건 대표 이미지

3줄 요약

이번 방문에서 한 편은 바로 볼 수 있습니다.

집에 둔 컴퓨터가 밤새 AI 에이전트를 돌리고, 저는 폰으로 결과만 확인하는 구성이 있습니다. 일을 실제로 실행하는 컴퓨터를 실행체, 그 화면을 보는 기기를 뷰어라고 부르겠습니다. 지금까지 이 구성에서 실행체가 되는 컴퓨터는 통합 메모리가 넉넉한 맥이거나 고가 그래픽카드를 꽂은 데스크톱이었는데, 2026년 10월부터는 윈도우 노트북과 소형 데스크톱에도 같은 선택지가 생깁니다. 엔비디아가 IFA 2026에서 출시 시점을 밝힌 RTX 스파크 이야기입니다.

RTX 스파크(RTX Spark)는 엔비디아가 2026년 10월 출시를 예고한 윈도우 PC용 슈퍼칩으로, 20코어 Grace CPU와 블랙웰 RTX GPU를 한 칩에 묶고 통합 메모리(unified memory)를 최대 128GB까지 얹은 제품입니다. 그래픽카드를 따로 꽂는 방식이 아니라 CPU와 GPU가 메모리 하나를 나눠 쓰는 구조라서, 로컬 모델을 돌릴 때 병목이 되는 메모리 한도가 그래픽카드 방식과 다르게 잡힙니다.

이 글에서는 2026년 9월 기준 공식 발표에서 확인되는 사양과, 로컬 AI 에이전트가 돌아가는 조건이 무엇인지, 이미 있는 맥 스튜디오나 RTX 5090 데스크톱과 무엇이 다른지를 정리하겠습니다. 실행체를 집에 두고 폰으로 보는 구성 자체는 테일스케일 사용법맥미니 tmux 설정 글에서 다뤘으므로, 여기서는 그 실행체가 될 컴퓨터 쪽만 봅니다.

위 이미지는 엔비디아 공식 블로그에 실린 발표 이미지입니다. 노트북 하부에 칩 하나와 팬 두 개가 들어간 모습이고, 그래픽카드가 따로 없다는 점이 이 제품의 구조를 그대로 보여 줍니다.

2026년 9월 기준 공식 발표에서 확인되는 RTX 스파크 사양

RTX 스파크는 2026년 6월 컴퓨텍스에서 처음 공개됐고, 9월 IFA에서 출시 시점과 소프트웨어 지원이 더해졌습니다. 엔비디아 공식 발표에 적힌 값만 모으면 아래와 같습니다.

항목
CPU20코어 NVIDIA Grace (미디어텍과 공동 설계)
GPU블랙웰 RTX, CUDA 코어 6,144개, 5세대 텐서 코어(FP4, 4비트 정밀도)
AI 연산최대 1페타플롭
통합 메모리최대 128GB
CPU와 GPU 연결NVLink-C2C
운영체제윈도우
형태14~16인치 노트북과 소형 데스크톱
제조사ASUS, 델, HP, 레노버, 마이크로소프트 서피스, MSI. 에이서와 기가바이트가 뒤따름
출시2026년 10월
가격미공개

가격은 2026년 9월 초 기준으로 엔비디아도 제조사도 밝히지 않았습니다. 증권사 추정치가 기사에 돌고 있지만 확인된 값이 아니라서 이 글에서는 옮기지 않습니다. 메모리 대역폭 수치도 공식 발표문에는 없고 매체 보도에만 있어서 같은 이유로 뺐습니다.

엔비디아는 이 칩으로 파라미터 1,200억 개 모델을 100만 토큰 컨텍스트로 로컬에서 실행한다고 발표했습니다. 제조사가 직접 낸 수치이므로 참고용으로 보되, 어떤 크기의 모델이 목표인지는 여기서 읽힙니다.

로컬 에이전트가 돌아가는지는 통합 메모리가 정합니다

로컬 모델이라는 개념은 클라우드 챗봇보다 상대적으로 낯설 수 있습니다. 쉽게 말하면 모델 파일을 내려받아 내 컴퓨터 안에서만 실행하는 방식이고, 자료가 밖으로 나가지 않으며 토큰 요금이 없습니다. 준이아빠블로그에서 Qwen3.8 27B를 24GB 맥에서 돌린 결과메타 뮤즈 글리머의 실행 조건을 정리하면서 확인한 것이 하나 있는데, 실행이 되는지 안 되는지를 정하는 것은 연산 속도가 아니라 메모리였습니다.

목수가 작업대보다 큰 널빤지를 올려놓을 수 없듯, 모델은 가중치 전체가 GPU가 쓰는 메모리에 한 번에 올라가야 돌아갑니다. 그래픽카드 방식에서는 카드에 붙은 전용 메모리(VRAM)가 그 작업대이고, 소비자용 카드 가운데 큰 축인 RTX 5090도 32GB입니다. 통합 메모리 방식에서는 CPU와 나눠 쓰는 메모리 전체가 작업대가 되므로, 같은 값이면 훨씬 넓은 작업대가 나옵니다. 애플 실리콘 맥이 로컬 모델용으로 자주 언급된 이유가 이것이고, RTX 스파크는 같은 구조를 윈도우 쪽에 가져온 셈입니다.

24GB 맥에서 17GB 모델이 CPU로 떨어진 것도 작업대 문제였습니다. 파일은 메모리보다 작았지만 GPU에 배정할 수 있는 몫이 모자랐습니다. 128GB면 그 한도가 다섯 배가 넘고, 엔비디아가 말한 1,200억 파라미터 모델은 4비트로 압축했을 때 대략 그 안에 들어가는 크기입니다. 이 계산은 제조사 발표를 근거로 한 추정이라, 실제로 어떤 모델이 어떤 속도로 돌아가는지는 출시 뒤 실측이 나와야 알 수 있습니다.

맥 스튜디오, RTX 5090 데스크톱과의 비교

지금 로컬 에이전트용으로 살 수 있는 컴퓨터와 나란히 놓으면 RTX 스파크의 위치가 보입니다. 수치는 각 회사 공식 페이지에 적힌 것만 썼습니다.

항목RTX 스파크 PC맥 스튜디오 M5 MaxRTX 5090 데스크톱
모델이 올라가는 메모리통합 메모리 최대 128GB통합 메모리 최대 128GB그래픽카드 VRAM 32GB
메모리 구조CPU와 GPU가 나눠 씀CPU와 GPU가 나눠 씀카드 전용
AI 연산 (제조사 표기)최대 1페타플롭 (FP4)표기 없음3,352 AI TOPS
운영체제윈도우macOS윈도우 또는 리눅스
형태노트북, 소형 데스크톱데스크톱데스크톱 (카드 별도 장착)
시작 가격 (2026년 9월 기준)미공개2,499달러카드 가격 별도, 본체 구성에 따라 다름
구할 수 있는 시점2026년 10월2026년 9월 22일 출하판매 중

같은 128GB인데 한쪽은 맥이고 한쪽은 윈도우라는 점이 이 표에서 눈에 띄는 차이입니다. 로컬 에이전트 도구 가운데는 윈도우 앱으로 먼저 나오는 것이 있고, 회사 업무 도구가 윈도우에 묶인 경우도 많습니다. 그동안 그런 환경에서는 그래픽카드 32GB 안에서 모델을 골라야 했는데, 그 제약을 푸는 것이 RTX 스파크입니다.

맥 스튜디오 M5 Ultra는 통합 메모리를 512GB까지 올릴 수 있어서 더 큰 모델이 목표라면 여전히 맥 쪽이 위입니다. 다만 그 구성은 시작 가격이 5,499달러이고 512GB판은 10월 말에나 나오므로, 128GB 구간에서 두 제품이 겹치고 그 위는 맥만 있는 모양으로 보입니다.

같은 날 풀린 소프트웨어 지원

IFA 발표는 칩만이 아니라 로컬 실행 소프트웨어까지 한 묶음이었습니다. 이 부분은 RTX 스파크를 기다리지 않아도 지금 쓰는 그래픽카드에 바로 해당됩니다.

  • llama.cpp와 vLLM 최적화: 로컬 모델을 실행하는 두 엔진에 엔비디아 GPU용 최적화가 들어갔고, llama.cpp는 RTX 5090 기준 처리량이 최대 1.9배 늘었다고 발표됐습니다. 이 수치는 RTX 스파크가 아니라 기존 카드에서 잰 값입니다.
  • LM Studio와 Ollama: 두 프로그램이 이 최적화된 백엔드를 지원합니다. 명령 몇 줄로 모델을 받아 실행하는 도구라서, 로컬 모델을 처음 써 볼 때 먼저 만나는 이름입니다.
  • Hermes Agent, OpenClaw, Perplexity Portable Computer: 로컬에서 돌아가는 에이전트 세 가지에 엔비디아 GPU 지원이 붙었습니다. Hermes Agent는 윈도우에서 클릭 한 번으로 설치되고, OpenClaw는 VRAM 24GB 이상 RTX 카드용 윈도우 앱으로 나왔으며, Perplexity의 것은 리눅스에서 먼저 돌아가고 윈도우는 뒤에 온다고 되어 있습니다.
  • NVIDIA PAIR: 같은 네트워크에 있는 PC 여러 대에 추론을 나눠 돌리는 무료 오픈소스 도구입니다. 집에 컴퓨터가 두 대 이상이면 작업대를 이어 붙이는 셈이 됩니다.

정리하면 실행 엔진, 실행 프로그램, 에이전트, 분산 도구가 같은 날 나란히 나왔습니다. 칩 하나가 아니라 집 컴퓨터에서 에이전트를 돌리는 길 전체를 열어 두겠다는 발표로 읽힙니다.

집 컴퓨터가 실행체가 되는 구성

여기까지가 사양이고, 이 사양이 실제 일에서 무엇을 바꾸는지는 구성을 놓고 봐야 드러납니다. 제가 쓰는 방식은 집 컴퓨터 한 대가 실행체이고 노트북과 폰은 그 화면을 보는 뷰어입니다. 집 컴퓨터에서 AI가 종일 돌아가고, 저는 지하철에서 폰으로 질문에 답하거나 카페에서 노트북을 열어 이어 봅니다.

예를 들어 저녁에 집 컴퓨터의 로컬 에이전트에게 이번 주 받은 자료 수십 개를 읽고 항목별로 정리하라고 맡겨 두면, 밤사이 그 작업이 클라우드로 자료를 보내지 않은 채 진행됩니다. 아침에 폰으로 결과를 열어 보고, 빠진 항목만 한 줄로 다시 시킵니다. 이 흐름에서 실행체가 하는 일은 셋입니다.

  • 모델을 메모리에 올려 두고 요청이 올 때마다 바로 답합니다.
  • 에이전트가 파일을 읽고 쓰고 명령을 실행하는 작업 공간이 됩니다.
  • 항상 켜져 있어서 뷰어가 언제 붙어도 같은 화면을 보여 줍니다.

지금까지 이 실행체를 윈도우 노트북으로 두기는 어려웠습니다. 그래픽카드가 들어간 노트북은 VRAM이 데스크톱 카드보다 작아 돌릴 수 있는 모델이 좁았고, 데스크톱은 24시간 켜 두기에 전력과 소음이 부담이 되기 쉬웠습니다. RTX 스파크가 노트북 두께 14mm에 무게 3파운드(약 1.4kg)로 나온다는 발표대로라면, 작업대 128GB짜리 실행체를 책상 구석에 두고 폰으로 보는 구성이 윈도우에서도 성립할 것으로 보입니다.

로컬에 맞는 일과 여전히 클라우드가 맞는 일

128GB가 생긴다고 모든 AI 작업이 집으로 오는 것은 아닙니다. 준이아빠블로그에서 로컬 모델을 다루면서 정리된 기준은 이렇습니다.

로컬 실행체에 맞는 일클라우드가 여전히 맞는 일
밖으로 내보내기 어려운 자료를 읽고 정리하는 반복 작업가장 좋은 답이 필요한 한 번짜리 질문
토큰 요금 없이 밤새 돌려야 하는 긴 작업최신 대형 모델의 추론 품질이 결과를 정하는 코딩과 분석
인터넷이 끊겨도 돌아가야 하는 작업여러 사람이 같은 결과를 동시에 봐야 하는 협업
화면을 조작하거나 파일을 옮기는 에이전트 작업검색과 최신 정보 결합이 핵심인 작업

클라우드 모델과 로컬 모델의 품질 차이는 2026년 9월 기준으로도 남아 있는 것으로 보이고, 로컬은 그 차이를 자료 통제와 비용으로 메우는 쪽입니다. 그래서 집 컴퓨터가 실행체가 되더라도 클라우드 API는 함께 씁니다. 로컬 에이전트가 자료를 정리하고, 마지막 판단이 필요한 대목만 클라우드 모델에 묻는 식으로 나누는 것이 현실적으로 보입니다. 엔비디아가 함께 발표한 OpenShell도 어떤 요청을 로컬에 두고 어떤 요청을 클라우드로 보낼지 정책으로 정하는 도구라고 설명하고 있어서, 이 나눔을 전제로 만든 것으로 읽힙니다.

출시 전에 판단을 미뤄도 되는 이유

발표만 놓고 보면 기대가 앞서기 쉬운데, 2026년 9월 기준으로 비어 있는 것이 셋입니다.

  • 가격: 엔비디아도 제조사도 밝히지 않았습니다. 128GB 구성이 맥 스튜디오 M5 Max의 2,499달러와 어느 쪽에 놓이는지에 따라 판단이 달라집니다.
  • 실측 벤치마크: 1페타플롭과 1,200억 파라미터는 제조사 발표입니다. 어떤 모델이 초당 몇 토큰으로 돌아가는지는 출시 뒤 실측이 있어야 합니다.
  • 윈도우 온 암 호환성: Grace는 Arm 계열 CPU라서 기존 윈도우 프로그램이 전부 그대로 돌아가는지는 나와 봐야 압니다. 로컬 에이전트가 쓰는 도구 가운데 아직 x86만 지원하는 것이 있을 수 있습니다.

그래서 지금 정할 일은 구매가 아닙니다. 대신 집 컴퓨터를 실행체로 두고 폰으로 보는 구성 자체는 지금 있는 컴퓨터로 미리 익혀 둘 수 있습니다. 그 구성에 익숙해져 있으면 10월에 실측이 나왔을 때 실행체만 바꾸면 되고, 그렇지 않으면 사양을 확인하는 일과 구성을 익히는 일을 한꺼번에 하게 됩니다. 이 글의 전망은 발표문을 근거로 한 추정이고, 10월 이후 실측과 가격이 나오면 고쳐 적겠습니다.

RTX 스파크 가격은 얼마인가요?

2026년 9월 초 기준으로 공식 가격은 없습니다. 엔비디아는 컴퓨텍스와 IFA 발표 어디에도 가격을 적지 않았고, 제조사들도 출시에 맞춰 밝히겠다는 입장입니다. 기사에 도는 증권사 추정치는 확인된 값이 아니므로 구매 계획의 근거로 삼지 않는 편이 안전합니다.

지금 쓰는 RTX 5090 PC로는 부족한가요?

모델 크기에 따라 다릅니다. RTX 5090은 VRAM이 32GB라 4비트로 압축한 300억 파라미터 안팎 모델까지가 대략 편하게 올라가는 범위이고, 연산 성능 표기는 3,352 AI TOPS로 넉넉합니다. 이번에 나온 llama.cpp 최적화도 RTX 5090 기준으로 최대 1.9배가 발표됐습니다. 300억 파라미터 안쪽 모델로 에이전트를 돌린다면 지금 카드로 충분하고, 그보다 큰 모델을 한 대에서 돌리려는 경우에만 128GB 통합 메모리가 필요합니다.

맥이 있으면 RTX 스파크를 기다릴 이유가 있나요?

통합 메모리가 넉넉한 맥을 이미 쓰고 있다면 실행체로서는 같은 구간에 있으므로 기다릴 이유가 크지 않습니다. RTX 스파크가 소용이 있는 쪽은 윈도우 전용 도구나 업무 환경에 묶여 있어서 맥을 실행체로 두기 어려웠던 경우입니다. 로컬 에이전트 가운데 윈도우 앱으로 먼저 나오는 것들이 있다는 점도 이쪽에 해당합니다.

3줄 요약

  1. RTX 스파크는 엔비디아가 2026년 10월 출시를 예고한 윈도우 PC용 슈퍼칩으로, 20코어 Grace CPU와 블랙웰 RTX GPU에 통합 메모리를 최대 128GB까지 얹었습니다. 그래픽카드를 꽂는 방식이 아니라 CPU와 GPU가 메모리 하나를 나눠 쓰는 구조입니다.
  2. 로컬 AI 에이전트가 돌아가는지는 연산보다 메모리가 정하고, 128GB면 엔비디아 발표 기준 1,200억 파라미터 모델까지 한 대에서 실행됩니다. 같은 128GB인 맥 스튜디오 M5 Max와 겹치고, 그 위 구간은 512GB까지 가는 맥만 있습니다.
  3. 가격과 실측 벤치마크가 아직 없으므로 지금 정할 일은 구매가 아닙니다. 집 컴퓨터를 실행체로 두고 폰으로 보는 구성을 지금 컴퓨터로 익혀 두면, 10월에 실측이 나왔을 때 실행체만 바꾸면 됩니다.

Sources

이 글이 도움이 되셨다면 공유해 주세요

메신저로 바로 보내거나 링크를 복사할 수 있습니다.

Author

Written by

데이터로 설명하는 마케터

퀴즈

로컬 AI 에이전트가 집 컴퓨터에서 돌아가는지를 가장 먼저 정하는 사양은 무엇일까요?

이 글이 도움이 되었나요?

다음 단계

이어서 읽기 좋은 글

Qwen3-TTS 내 목소리 학습: 맥미니에서 미세조정한 과정과 결과

Qwen3-TTS는 알리바바 큐원 팀이 2026년 1월 아파치 2.0으로 공개한 오픈소스 음성 합성 모델입니다. 통합 메모리 24GB 맥미니에서 녹음 13초로 제로샷 복제를 하고, 31분 녹음으로 0.6B 모델을 미세조정해 참조 음성 없이 내 목소리를 내게 만든 과정과 원리, 필요한 사양, 감정 표현을 넣는 방법을 정리했습니다.

다음 글 읽기

같이 보면 좋은 글

맥미니 한 대에 tmux 세션 두고 맥북과 아이폰에서 SSH로 AI 작업 이어가기 썸네일
AI & Tech맥미니 한 대에 tmux 세션 두고 맥북과 아이폰에서 SSH로 AI 작업 이어가기

tmux는 터미널 세션을 컴퓨터 안에 남겨 두었다가 다른 기기에서 그대로 이어 받게 해 주는 터미널 멀티플렉서입니다. 집 맥 한 대에 세션을 켜 두고 테일스케일로 묶인 맥북과 아이폰에서 SSH로 들어와 클로드 코드 화면을 이어 쓰는 설정 순서를 정리했습니다.

2026. 9. 7.
테일스케일(Tailscale) 사용법: 어디서든 내 집, 회사의 컴퓨터를 활용해 AI로 일하는 방식 썸네일
AI & Tech테일스케일(Tailscale) 사용법: 어디서든 내 집, 회사의 컴퓨터를 활용해 AI로 일하는 방식

테일스케일은 집과 회사와 가방 속 기기를 하나의 사설 네트워크로 묶어 이름만으로 서로 부르게 하는 VPN 도구입니다. 집 컴퓨터 한 대를 24시간 AI 작업 서버로 두고 노트북과 회사 컴퓨터, 스마트폰에서 이어 쓰는 구성과 설치 순서를 정리했습니다.

2026. 9. 6.
intent.md 작성법과 사용 예시, 앤트로픽 AI 네이티브 SDLC 플레이북 정리 썸네일
AI & Techintent.md 작성법과 사용 예시, 앤트로픽 AI 네이티브 SDLC 플레이북 정리

intent.md는 앤트로픽 AI 네이티브 SDLC 플레이북에서 코드를 쓰기 전에 무엇을 왜 만들지 적어 두는 첫 번째 문서입니다. 클로드에게 질문을 시켜 만드는 절차와 그대로 가져다 쓸 수 있는 예시 세 가지, PRD와 TRD에서 무엇이 달라졌는지, 이어지는 spec.md와 plan.md의 역할까지 다룹니다.

2026. 9. 5.
GPT-6 아스트라 AGI 논쟁, ARC-AGI-3 99.9%의 조건과 사무직 전망 썸네일
AI & TechGPT-6 아스트라 AGI 논쟁, ARC-AGI-3 99.9%의 조건과 사무직 전망

GPT-6 아스트라는 OpenAI가 2026년 9월 3일 공개한, 컴퓨터를 사람처럼 직접 조작하는 데 초점을 둔 모델입니다. 이번 출시가 왜 예전 모델 발표와 다른 반응을 얻었는지, 클로드 페이블 5.1과 제미나이 3.8 플래시와 견주면 어디에 서는지, ARC-AGI-3 99.9%와 Critical 사이버 등급이 무엇을 상징하는지 정리하고 사무직과 AI 전환기의 중장기 방향을 조심스럽게 전망했습니다.

2026. 9. 5.

ADVERTISEMENT

이 글의 학습 경로

글 전체 보기

관련 개념

무료 셀프 교육으로 배워보세요

코스 전체 보기