NVIDIA DGX Spark 제품 이미지
NVIDIA · AI 슈퍼컴퓨터

NVIDIA DGX Spark

GB10 그레이스 블랙웰 데스크톱 AI 슈퍼컴퓨터

별도 문의구성·수량에 따라 견적이 달라집니다
프로세서GB10 Grace Blackwell통합 메모리128GB LPDDR5XAI 성능최대 1 PFLOP모델 규모추론 2,000억 파라미터설치 조건240W · 1.2kg공급엑스디노드

제품 개요

핵심만 먼저 — 자세한 설명은 아래에서 펼쳐 볼 수 있습니다.

NVIDIA DGX Spark는 책상 위에 두고 쓰는 완제품 AI 개발 장비입니다. GB10 Grace Blackwell Superchip을 중심으로 GPU와 CPU, 메모리, 스토리지, 네트워크를 하나의 본체에 담았고, NVIDIA DGX OS와 AI 소프트웨어 스택이 사전 설치된 상태로 출하됩니다. 데이터센터용 DGX와 같은 소프트웨어 환경을 쓰되 규모를 줄인 제품으로, NVIDIA는 여기서 개발한 작업을 이후 DGX Cloud나 NVIDIA 가속 데이터센터로 옮기는 흐름을 상정합니다. 엑스디노드가 국내 공급과 도입 지원을 담당합니다.

프로세서GB10 Grace BlackwellBlackwell GPU + 20코어 Arm CPU 통합 패키지
통합 메모리128GB LPDDR5X코히런트 통합 메모리, 256비트 273GB/s
AI 성능최대 1 PFLOPFP4 기준, 5세대 Tensor Core
모델 규모추론 2,000억 파라미터파인튜닝 700억 / 2대 연결 시 4,050억
설치 조건240W · 1.2kg150×150×50.5mm, 랙·별도 공조 불필요
공급엑스디노드구성·수량에 따라 가격 별도 문의
개요 전체 읽기

GB10은 Blackwell 아키텍처 GPU와 20코어 Arm CPU를 한 패키지에 담은 구성입니다. GPU는 5세대 Tensor Core와 4세대 RT Core를 포함하며 FP4 기준 최대 1 PFLOP의 AI 성능을 냅니다. CPU는 Cortex-X925 10코어와 Cortex-A725 10코어로 이루어집니다. 미디어 엔진은 NVENC와 NVDEC를 각각 하나씩 갖췄습니다.

메모리는 128GB LPDDR5X 코히런트 통합 시스템 메모리이며 256비트 인터페이스에 대역폭은 273GB/s입니다. CPU와 GPU가 같은 메모리 공간을 공유하므로 장치 간 복사 없이 큰 모델을 적재할 수 있고, NVIDIA는 단일 장비 기준 추론 최대 2,000억 파라미터, 파인튜닝 최대 700억 파라미터 모델을 제시합니다. ConnectX-7 200Gb/s NIC으로 두 대를 연결하면 최대 4,050억 파라미터까지 다룰 수 있습니다. 스토리지는 자체 암호화를 지원하는 4TB NVMe M.2이고, 입출력은 USB Type-C 4포트, 10GbE RJ-45 1포트, HDMI 2.1a 1포트, USB-C 경유 DisplayPort 최대 3개, Wi-Fi 7, 블루투스 5.4를 갖췄습니다.

전원은 240W이며 GB10 자체 TDP는 140W입니다. 크기는 150mm × 150mm × 50.5mm, 무게는 1.2kg으로 랙이나 별도 공조 설비 없이 일반 사무 공간의 콘센트에 연결해 사용할 수 있습니다. 서버실을 준비하지 않고도 도입할 수 있다는 점이 실제 도입 문턱을 낮추는 부분입니다. 다만 메모리 대역폭 273GB/s는 HBM 기반 데이터센터 GPU와 차이가 크므로, 대역폭에 민감한 대규모 학습 처리량을 기대하기에는 맞지 않습니다.

모델 프로토타이핑, 파인튜닝, 로컬 추론 검증이 주 용도인 개인 연구자와 소규모 팀에 맞습니다. 데이터 반출이 제한되어 클라우드 GPU를 쓰기 어려운 환경이나, 클라우드 인스턴스 확보 대기 시간을 줄이려는 팀에도 쓸 만합니다. 반대로 상시 프로덕션 추론 서비스나 대규모 사전학습이 목적이라면 DGX B200이나 DGX B300, 또는 서버용 GPU 구성이 맞습니다. 두 대까지는 ConnectX-7로 묶을 수 있지만 그 이상 규모의 클러스터를 전제로 설계된 제품은 아닙니다.

상세 사양

제조사 공식 문서 기준입니다.

프로세서 및 성능

아키텍처NVIDIA Grace Blackwell (GB10 Grace Blackwell Superchip)
GPUNVIDIA Blackwell 아키텍처
Tensor Core5세대
RT Core4세대
CPU20코어 Arm (Cortex-X925 10코어 + Cortex-A725 10코어)
AI 성능최대 1 PFLOP (FP4)
미디어 엔진NVENC 1개 / NVDEC 1개

메모리 및 스토리지

메모리 용량128GB
메모리 종류LPDDR5X 코히런트 통합 시스템 메모리
메모리 인터페이스256비트
메모리 대역폭273GB/s
스토리지4TB NVMe M.2 (자체 암호화 지원)
지원 모델 규모 (추론)최대 2,000억 파라미터
지원 모델 규모 (파인튜닝)최대 700억 파라미터
2대 연결 시최대 4,050억 파라미터

네트워크 및 입출력

NICNVIDIA ConnectX-7, 200Gb/s
이더넷RJ-45 10GbE 1포트
무선Wi-Fi 7
블루투스BT 5.4
USBUSB Type-C 4포트
디스플레이 출력HDMI 2.1a 1포트, USB-C 경유 DisplayPort 최대 3개

전원·물리·소프트웨어

전원240W
GB10 TDP140W
크기150mm(L) × 150mm(W) × 50.5mm(H)
무게1.2kg
운영체제NVIDIA DGX OS
소프트웨어NVIDIA AI 소프트웨어 스택 사전 설치 (NVIDIA NIM 등), NVIDIA AI Enterprise 별도 이용 가능

구성 예시와 활용

실제 도입 문의가 많은 방향입니다.

모델 프로토타이핑과 로컬 파인튜닝

128GB 통합 메모리로 최대 700억 파라미터 모델의 파인튜닝을 책상 위에서 진행할 수 있습니다. 클라우드 GPU 인스턴스 확보를 기다리지 않고 반복 실험을 돌릴 수 있어 개발 주기를 줄이는 데 쓰입니다.

데이터 반출이 제한된 환경의 추론 검증

외부로 데이터를 보내기 어려운 조직에서 로컬 추론과 검증을 수행하는 용도로 적합합니다. 스토리지가 자체 암호화를 지원하는 4TB NVMe M.2라는 점도 보안 요건 검토 시 확인 항목이 됩니다.

데이터센터 이관을 전제로 한 개발 환경

DGX OS와 NVIDIA AI 소프트웨어 스택이 데이터센터 DGX와 동일해, 개발 단계 결과물을 DGX Cloud나 NVIDIA 가속 인프라로 옮길 때 환경 차이가 적습니다. 개발 장비와 운영 장비의 스택을 통일하려는 팀에 맞습니다.

2대 연동 구성의 대형 모델 실험

내장 ConnectX-7 200Gb/s로 두 대를 연결하면 최대 4,050억 파라미터 모델까지 다룰 수 있습니다. 소규모 팀이 대형 모델 동작을 사전 검증한 뒤 서버급 도입 규모를 산정하는 단계에 활용됩니다.

자주 묻는 질문

구매 담당자가 실제로 묻는 것들입니다.

128GB 통합 메모리로 실제 어느 정도 모델까지 다룰 수 있습니까?

NVIDIA는 단일 장비 기준으로 추론 최대 2,000억 파라미터, 파인튜닝 최대 700억 파라미터를 제시합니다. CPU와 GPU가 메모리를 공유하는 코히런트 구조라 별도 VRAM 한계에 맞춰 모델을 쪼갤 필요가 줄어듭니다. 다만 양자화 방식과 컨텍스트 길이, 배치 크기에 따라 실제 적재 가능 범위는 달라집니다.

여러 대를 묶어서 쓸 수 있습니까?

ConnectX-7 200Gb/s NIC이 내장되어 두 대를 연결할 수 있고, 이 구성에서 최대 4,050억 파라미터 모델까지 다룰 수 있습니다. NVIDIA가 공식적으로 안내하는 확장 범위는 2대 연결까지이며, 그 이상 규모의 클러스터를 목적으로 설계된 제품은 아닙니다. 더 큰 규모가 필요하면 DGX B200이나 DGX B300 기반 구성을 검토하는 편이 맞습니다.

학습 서버 대신 쓸 수 있습니까?

메모리 대역폭이 273GB/s로, HBM3e 기반 데이터센터 GPU와는 대역폭 차이가 큽니다. 따라서 대규모 사전학습이나 처리량 중심의 상시 학습 용도로는 적합하지 않습니다. 모델 프로토타이핑, 소규모 파인튜닝, 로컬 추론 검증까지가 이 제품이 상정한 범위이고, 이후 작업은 DGX Cloud나 가속 데이터센터로 이관하는 흐름을 전제로 합니다.

설치에 필요한 환경 조건은 어떻게 됩니까?

전원은 240W이고 크기 150×150×50.5mm, 무게 1.2kg입니다. 랙이나 별도 공조 설비가 필요 없고 일반 사무 공간의 전원 콘센트에서 동작합니다. 유선은 10GbE RJ-45와 ConnectX-7 200Gb/s를 지원하고 Wi-Fi 7도 내장되어 있어 네트워크 구성 선택지가 넓습니다.

어떤 소프트웨어가 포함되어 있습니까?

NVIDIA DGX OS가 사전 설치되어 출하되며 NVIDIA AI 소프트웨어 스택과 NVIDIA NIM 마이크로서비스를 포함한 생태계를 지원합니다. 데이터센터 DGX와 동일한 소프트웨어 환경을 쓰기 때문에, 여기서 만든 워크로드를 이후 대형 시스템으로 옮길 때 환경 차이가 적습니다. NVIDIA AI Enterprise는 별도 이용 형태로 제공됩니다.

가격은 얼마입니까?

구성과 수량, 스토리지 옵션, 도입 형태에 따라 달라져 별도 문의로 안내합니다. 도입 대수와 용도를 알려주시면 엑스디노드에서 회신드립니다.

함께 검토하는 제품

같은 분류에서 자주 비교됩니다.

NVIDIA

NVIDIA DGX B300

블랙웰 울트라 GPU 8장의 10RU 통합 AI 시스템

별도 문의

NVIDIA

NVIDIA DGX B200

블랙웰 GPU 8장, 1.4TB 메모리 통합 AI 시스템

별도 문의

ASUS

ASUS Ascent GX10

PCIe 5.0 4TB까지 선택되는 GB10 데스크톱

별도 문의

MSI

MSI IPC EdgeXpert MS-C931

1.2kg 산업용 설계의 GB10 데스크톱

별도 문의