
NVIDIA
NVIDIA RTX PRO 6000 Blackwell Server Edition
패시브 냉각 96GB 데이터센터 GPU

32GB GDDR7, 200W 이중폭 전문가용 GPU
핵심만 먼저 — 자세한 설명은 아래에서 펼쳐 볼 수 있습니다.
NVIDIA RTX PRO 4500 Blackwell은 Blackwell 세대 RTX PRO 라인업의 중급 모델로, 48GB·300W의 RTX PRO 5000 아래, 24GB·145W의 RTX PRO 4000 위에 놓인다. 32GB GDDR7 메모리와 200W 총 보드 전력을 조합해, 전력과 슬롯 예산이 제한된 환경에서 전문가용 워크로드를 처리하도록 잡힌 위치다. 설계·엔지니어링·데이터 사이언스 워크스테이션과 GPU 확장형 서버 양쪽에서 쓰이는 이중 슬롯 풀하이트 카드다. 같은 이름의 패시브 냉각 서버 에디션이 별도 제품으로 존재하므로, 구매 시 워크스테이션 에디션인지 서버 에디션인지 구분이 필요하다. 국내 공급과 서버 동시 구성 문의는 엑스디노드에서 받는다.
| 메모리 | 32GB GDDR7 ECC — 256-bit, 896GB/s |
|---|---|
| CUDA 코어 | 10,496개 — Blackwell, 5세대 텐서·4세대 RT |
| 전력 | 200W — PCIe CEM5 16핀 1개 |
| 폼팩터 | 이중 슬롯 FHFL — 4.4" x 10.5", 액티브 블로워 |
| 인터페이스 | PCIe 5.0 x16 — DisplayPort 2.1b 4개 |
| 서버 에디션 | 165W 단일 슬롯 패시브 — 랙 밀집용 별도 제품 |
연산 구성은 CUDA 코어 10,496개, 5세대 텐서 코어, 4세대 RT 코어다. 5세대 텐서 코어는 FP4 정밀도를 지원해 생성형 AI 처리 시 메모리 사용량을 줄이면서 로컬 LLM 파인튜닝을 다룰 수 있고, 4세대 RT 코어는 전 세대 대비 광선-삼각형 교차 처리율이 두 배로 표기된다. 신경망 셰이더를 처리하도록 확장된 SM 구조와 DLSS 4 멀티 프레임 생성이 함께 지원된다. AI 성능은 NVIDIA 공식 데이터시트에는 수치가 없고, 보드 파트너 사양표 기준 1,687 AI TOPS(FP4·희소성 적용)로 표기된다.
메모리는 GDDR7 32GB에 ECC를 지원하고, 256-bit 인터페이스에서 896GB/s 대역폭이 나온다. RTX PRO 5000의 384-bit·1,344GB/s와 비교하면 인터페이스 폭과 대역폭에서 차이가 나므로, 메모리 대역폭이 지배하는 워크로드에서는 이 격차를 미리 계산해 두는 편이 좋다. 시스템 연결은 PCIe 5.0 x16이며, NVIDIA 공식 사양표에 NVLink 항목이 없어 다중 GPU 통신은 PCIe 경유를 전제로 한다. 워크스테이션 데이터시트에는 MIG 항목이 없으며, 카드 분할이 필요하면 MIG를 명시한 RTX PRO 5000 계열이나 서버 에디션 쪽을 봐야 한다. 디스플레이는 DisplayPort 2.1b 4개를 제공하고 8K 240Hz·16K 60Hz까지 사양상 명시된다.
총 보드 전력은 200W로 RTX PRO 5000의 300W보다 100W 낮으며, 보조 전원은 PCIe CEM5 16핀 커넥터 1개를 쓴다. 냉각은 블로워 팬 방식의 액티브 냉각이고 카드 크기는 높이 4.4인치, 길이 10.5인치, 이중 슬롯 풀하이트로 RTX PRO 5000과 동일하다. 즉 슬롯 점유 면적은 같지만 열 부하와 전원 부담이 낮아, 같은 섀시에 더 많은 장 수를 넣거나 전원 여유를 남기는 구성이 가능하다. 장 수를 늘릴 때는 16핀 보조 전원 케이블 개수와 파워서플라이 여유를 함께 계산해야 한다.
장착 대상 서버는 이중폭 FHFL PCIe Gen5 x16 슬롯을 제공하는 기종이면 되고, 슬롯당 요구 전력이 200W라 600W급 RTX PRO 6000용으로 검증된 섀시에서는 전력 배분이 한결 수월하다. 엑스디노드가 취급하는 MSI·GIGABYTE·Advantech 서버 중 GPU 확장을 전제로 한 기종이 대상이며, 다장착 시에는 슬롯 간격과 흡기 경로를 함께 확인해야 한다. 이 카드는 액티브 블로워 방식이므로, 패시브 GPU 기준으로 팬 커브가 설정된 랙 서버에서는 냉각 검증이 필요하다. 랙 밀집 구성이 목적이라면 165W·단일 슬롯·패시브 냉각으로 나온 RTX PRO 4500 Blackwell Server Edition이 별도 제품으로 있으므로 그쪽과 비교하는 편이 낫다. 어떤 섀시에 어떤 에디션을 몇 장 올릴지는 엑스디노드에서 사전 검토 후 안내한다.
32GB 안에서 처리되는 워크로드가 주력인 조직에 맞는다. 대형 CAD 어셈블리와 BIM 모델을 다루는 설계팀, 실시간 뷰포트 작업이 많은 DCC 워크스테이션, 중소형 모델 추론과 데이터 전처리를 겸하는 데이터 사이언스 환경이 대표적이다. 반대로 모델 용량이 32GB를 넘거나 메모리 대역폭이 병목이라면 48GB·1,344GB/s의 RTX PRO 5000이 맞고, 70B급을 한 장에 올려야 한다면 RTX PRO 5000 72GB 또는 RTX PRO 6000 쪽을 봐야 한다. 반대 방향으로 예산과 전력을 더 줄여야 하고 24GB로 충분하다면 145W 단일 슬롯의 RTX PRO 4000이 대안이 된다.
제조사 공식 문서 기준입니다.
| 메모리 용량 | 32GB |
|---|---|
| 메모리 종류 | GDDR7 (ECC 지원) |
| 메모리 인터페이스 | 256-bit |
| 메모리 대역폭 | 896GB/s |
| MIG 인스턴스 | 워크스테이션 에디션 데이터시트에 항목 없음 (서버 에디션은 최대 2x 16GB) |
| GPU 아키텍처 | NVIDIA Blackwell |
|---|---|
| CUDA 코어 | 10,496개 |
| 텐서 코어 | 5세대 / 328개 (코어 수는 보드 파트너 사양표 기준) |
| RT 코어 | 4세대 / 82개 (코어 수는 보드 파트너 사양표 기준) |
| AI 성능 | 1,687 AI TOPS (FP4·희소성 적용, 보드 파트너 사양표 기준 / NVIDIA 데이터시트 미기재) |
| 지원 정밀도 | FP4 지원 명시 (5세대 텐서 코어) |
| 기타 기능 | DLSS 4 멀티 프레임 생성, RTX Mega Geometry, AI Management Processor |
| 시스템 인터페이스 | PCIe 5.0 x16 |
|---|---|
| 총 보드 전력(TDP) | 200W |
| 보조 전원 커넥터 | PCIe CEM5 16핀 1개 |
| NVLink | NVIDIA 공식 사양표에 항목 없음 — 다중 GPU는 PCIe 5.0 x16 경유 |
| 디스플레이 출력 | DisplayPort 2.1b 4개 |
| 카드 크기 | 4.4인치(H) x 10.5인치(L) |
|---|---|
| 슬롯 폭 | 이중 슬롯(dual slot) |
| 브래킷 | 풀 하이트(full height) |
| 냉각 방식 | 액티브 (블로워 팬) |
| 필요 슬롯 | 이중폭 FHFL PCIe Gen5 x16 |
| 서버 에디션 폼팩터 | 단일 슬롯 FHFL·패시브 냉각·165W (별도 제품) |
| 디스플레이 커넥터 | DisplayPort 2.1b 4개 |
|---|---|
| 최대 동시 디스플레이 | 4x 3,840x2,160 @165Hz / 2x 7,680x4,320 @100Hz |
| 인코더 | NVENC 9세대 2기 (4:2:2 지원) |
| 디코더 | NVDEC 6세대 2기 (4:2:2 지원) |
| 그래픽 API | DirectX 12, Shader Model 6.6, OpenGL 4.6, Vulkan 1.3 |
| 컴퓨트 API | CUDA 11.6, OpenCL 3.0, DirectCompute (2025년 3월판 데이터시트 표기) |
실제 도입 문의가 많은 방향입니다.
수천만 폴리곤 규모의 어셈블리와 건축 모델을 32GB 메모리에 적재해 뷰포트 회전과 단면 확인을 지연 없이 처리합니다. 4세대 RT 코어와 RTX Mega Geometry로 상세 지오메트리의 레이트레이싱 미리보기를 설계 단계에서 바로 확인할 수 있습니다. DisplayPort 2.1b 4개로 도면·모델·시뮬레이션 창을 분리한 다중 모니터 구성이 가능합니다.
32GB 안에 들어오는 양자화 모델을 올려 사내 코드 어시스턴트나 문서 검색용 추론 노드로 쓰기 적합합니다. FP4를 지원하는 5세대 텐서 코어로 같은 모델을 더 적은 메모리에 적재할 수 있어 컨텍스트 여유가 생깁니다. 200W라는 전력 조건 덕분에 전력·발열 예산이 빠듯한 사무실 환경이나 엣지 랙에도 배치할 수 있습니다.
GPU 가속 데이터 프레임 처리, 특징 추출, 중간 규모 학습 실험처럼 대형 클러스터를 쓸 정도는 아닌 작업을 담당하는 노드로 적합합니다. PCIe Gen 5 x16 연결로 CPU 메모리와의 데이터 전송 구간에서 Gen 4 대비 대역폭 여유를 확보합니다. 여러 대를 나란히 배치해 사용자별 전용 노드로 운용하는 방식과도 잘 맞습니다.
제품 렌더링, 광고 비주얼, 실시간 3D 시각화처럼 씬 용량이 32GB 안에서 관리되는 제작 파이프라인에 씁니다. DLSS 4 멀티 프레임 생성으로 뷰포트와 실시간 엔진 작업의 프레임 지연을 줄일 수 있습니다. 9세대 NVENC 2기와 6세대 NVDEC 2기가 4:2:2 색상 포맷을 지원해 결과물 인코딩까지 같은 카드에서 처리됩니다.
구매 담당자가 실제로 묻는 것들입니다.
워크스테이션 에디션은 200W, 이중 슬롯, 액티브 블로워 냉각이고 DisplayPort 2.1b 출력 4개를 갖습니다. 서버 에디션은 165W, 단일 슬롯 FHFL, 패시브 냉각이며 NVIDIA 자료 기준 메모리 대역폭이 800GB/s로 낮고 최대 2x 16GB MIG와 vGPU를 지원합니다. 랙 밀집 배치가 목적이면 서버 에디션이, 워크스테이션이나 GPU 확장 서버 단독 장착이면 워크스테이션 에디션이 맞습니다.
메모리 32GB와 대역폭 896GB/s 안에서 워크로드가 처리되고, 랙 또는 시스템 전력 예산이 빠듯한 경우입니다. 슬롯 점유 면적은 RTX PRO 5000과 동일한 이중 슬롯이지만 전력이 200W로 100W 낮아 같은 섀시에서 장 수 확보가 수월합니다. 반대로 48GB 이상 용량이나 1,344GB/s 대역폭이 필요하면 RTX PRO 5000 쪽이 맞습니다.
NVIDIA 워크스테이션 에디션 데이터시트 사양표에는 MIG 항목이 없습니다. 서버 에디션은 최대 2개 인스턴스(각 16GB) 분할이 명시되어 있으므로, 분할 운용이 전제라면 서버 에디션이나 MIG를 명시한 RTX PRO 5000 계열을 검토하시는 편이 맞습니다.
이중폭 FHFL PCIe Gen5 x16 슬롯, 카드 길이 10.5인치를 수용하는 내부 공간, 카드당 PCIe CEM5 16핀 보조 전원 1개가 기본 조건입니다. 액티브 블로워 냉각이므로 카드 전면 흡기가 막히지 않는 배치와 섀시 팬 프로파일 확인도 필요합니다. 엑스디노드가 취급하는 MSI·GIGABYTE·Advantech 서버 기준으로 대상 모델을 알려 주시면 슬롯·전력 검토 후 안내드립니다.
NVIDIA 공식 데이터시트 사양표에 NVLink 항목이 없습니다. 여러 장을 장착하더라도 카드 간 통신은 PCIe 5.0 x16 경유로 이뤄집니다. 카드 간 대역폭이 성능을 좌우하는 워크로드라면 이 점을 설계 단계에서 반영해야 합니다.
엑스디노드는 에디션(워크스테이션/서버), 수량, 서버 동시 구성, 유지보수 조건에 따라 견적이 달라져 전 제품 별도 문의로 안내합니다. 필요한 에디션과 장착 대상 서버를 알려 주시면 구성안과 함께 회신드립니다.
같은 분류에서 자주 비교됩니다.

NVIDIA
패시브 냉각 96GB 데이터센터 GPU

NVIDIA
600W 96GB 워크스테이션 플래그십

NVIDIA
300W로 낮춘 96GB 다중 장착형

NVIDIA
72GB 단일 GPU, 300W 이중폭 Gen5 카드