NVIDIA RTX PRO 4000 SFF 제품 이미지
NVIDIA · GPU

NVIDIA RTX PRO 4000 SFF

70W 로우 프로파일에 담은 24GB GDDR7

별도 문의구성·수량에 따라 견적이 달라집니다
GPU 메모리24GB GDDR7 ECC소비 전력총 보드 전력 70W폼팩터듀얼 슬롯 하프 하이트CUDA 코어8,960개연산 성능FP32 24 TFLOPS시스템 인터페이스PCIe 5.0 x8

제품 개요

핵심만 먼저 — 자세한 설명은 아래에서 펼쳐 볼 수 있습니다.

NVIDIA RTX PRO 4000 Blackwell SFF Edition은 풀사이즈 RTX PRO 4000과 같은 24GB 메모리·8,960개 CUDA 코어를 하프 하이트 카드에 옮겨 담은 제품입니다. NVIDIA는 이 제품을 저전력·소형 폼팩터용 워크스테이션 GPU로 규정하고 있습니다. 24GB라는 메모리 용량은 그대로 유지하면서 총 보드 전력을 70W로 낮춘 것이 설계의 핵심이며, 그 대가로 메모리 대역폭과 PCIe 레인 수가 줄어듭니다. 즉 이 제품은 '성능 등급'이 아니라 '설치 조건'을 기준으로 선택하는 카드입니다. 엑스디노드는 소형 워크스테이션 및 랙 서버 구성에 이 GPU를 포함해 공급합니다.

GPU 메모리24GB GDDR7 ECC192비트 인터페이스, 대역폭 432GB/s
소비 전력총 보드 전력 70W풀사이즈 RTX PRO 4000의 절반 수준
폼팩터듀얼 슬롯 하프 하이트약 68.6 x 167.6mm, 액티브 쿨링
CUDA 코어8,960개풀사이즈 RTX PRO 4000과 동일한 코어 수
연산 성능FP32 24 TFLOPSRT 73 TFLOPS, AI 770 TOPS
시스템 인터페이스PCIe 5.0 x8풀 렝스 커넥터, Mini DisplayPort 2.1b 4개
개요 전체 읽기

Blackwell 아키텍처에 CUDA 코어 8,960개, 5세대 Tensor 코어, 4세대 RT 코어를 탑재합니다. NVIDIA 제품 페이지 기준 단정밀도(FP32) 성능은 24 TFLOPS, RT 코어 성능은 73 TFLOPS, AI 성능은 770 AI TOPS입니다. CUDA 코어 수는 풀사이즈 RTX PRO 4000과 동일하지만 전력 한도가 절반이므로 실제 연산 성능은 낮게 나오며, 이 점이 두 제품을 가르는 실질적인 차이입니다. 5세대 Tensor 코어의 FP4 정밀도 지원과 4세대 RT 코어의 처리율 향상은 상위 모델과 동일하게 적용됩니다. 9세대 NVENC 2개, 6세대 NVDEC 2개가 4:2:2 10비트 인코딩·디코딩을 지원하므로 영상 파이프라인 성능은 풀사이즈와 같은 구성입니다.

메모리는 24GB GDDR7이며 ECC를 지원하고, 192비트 인터페이스에 대역폭은 432GB/s입니다. 같은 24GB이지만 풀사이즈 대비 대역폭이 약 64% 수준이므로, 메모리 대역폭에 민감한 대용량 배치 추론이나 대형 씬 렌더링에서는 차이가 드러납니다. 시스템 인터페이스는 PCIe 5.0 x8이며, 커넥터는 풀 렝스 PCIe 커넥터를 사용합니다. 즉 물리적으로는 x16 슬롯에 꽂히지만 전기적으로는 8레인만 사용하며, PCIe Gen5 x8은 Gen4 x16과 같은 대역폭이므로 대부분의 워크로드에서는 실질 제약이 크지 않습니다. 디스플레이 출력은 Mini DisplayPort 2.1b 4개이며, NVLink는 공식 사양표에 기재되어 있지 않습니다.

총 보드 전력은 70W이고 공식 사양표에는 보조 전원 커넥터 항목이 없습니다. 냉각은 액티브 방식으로 카드에 팬이 내장되어 있습니다. 크기는 2.7인치 x 6.6인치(약 68.6mm x 167.6mm), 듀얼 슬롯 하프 하이트입니다. 하프 하이트이므로 로우 프로파일 브래킷 기반 섀시에 들어가지만, 두께가 두 칸이라는 점이 실제 장착에서 더 중요한 제약입니다. 70W라는 전력은 카드 여러 장을 배치해도 섀시 전체 전력 예산이 빠르게 소진되지 않는다는 뜻이기도 합니다.

엑스디노드가 취급하는 MSI·GIGABYTE·Advantech 서버 기준으로 이 카드는 슬롯 높이보다 슬롯 폭이 변수입니다. 높이가 2.7인치로 낮아 하프 하이트 라이저 규격에는 맞지만 듀얼 슬롯 두께이므로, 한 칸짜리 로우 프로파일 라이저만 제공하는 1U 섀시에는 대부분 들어가지 않고 2U 이상 랙 서버나 컴팩트 워크스테이션이 실제 대상이 됩니다. 600W급 카드가 요구하는 이중폭 PCIe Gen5 슬롯과 전용 전원 배선에 비하면 요구 조건이 훨씬 가벼워, 슬롯당 전력 공급이 제한적인 엣지·소형 섀시에도 배치하기 쉽습니다. 전기적으로 PCIe 5.0 x8이라 슬롯 분기(bifurcation) 구성에서 레인을 아낄 수 있고, 이는 한 섀시에 여러 장을 꽂아야 할 때 유리하게 작용합니다. 다만 공식 사양표에 보조 전원 커넥터 항목이 없으므로 라이저가 카드에 공급하는 슬롯 전력과 서버 제조사의 GPU 검증 목록을 함께 확인하시는 편이 안전합니다.

24GB 메모리가 필요하지만 섀시 공간이나 전력이 제약인 경우가 이 제품의 자리입니다. 엣지 추론 노드, 제조 현장의 검사·비전 시스템, 소형 CAD 워크스테이션, 랙에 밀집 배치하는 그래픽·인코딩 노드가 대표적입니다. 반대로 같은 24GB에서 최대 성능을 뽑아야 하는 렌더링·파인튜닝 작업이라면 대역폭 672GB/s에 PCIe x16을 쓰는 풀사이즈 RTX PRO 4000이 낫습니다. 24GB까지 필요하지 않고 16GB로 충분하다면 같은 70W·같은 크기의 RTX PRO 2000이 더 합리적인 선택이 될 수 있습니다.

상세 사양

제조사 공식 문서 기준입니다.

메모리

메모리 용량24GB
메모리 종류GDDR7 (ECC 지원)
메모리 인터페이스192비트
메모리 대역폭432GB/s

연산

GPU 아키텍처NVIDIA Blackwell
CUDA 코어8,960개
Tensor 코어5세대 (FP4 정밀도 지원)
RT 코어4세대
단정밀도(FP32) 성능24 TFLOPS
RT 코어 성능73 TFLOPS
AI 성능770 AI TOPS
컴퓨트 APICUDA 12.8, OpenCL 3.0
그래픽 APIDirectX 12, Shader Model 6.7, OpenGL 4.6, Vulkan 1.4

인터페이스·전력

시스템 인터페이스PCIe 5.0 x8 (풀 렝스 PCIe 커넥터 사용)
소비 전력총 보드 전력 70W
보조 전원 커넥터공식 사양표에 미기재
NVLink공식 사양표에 미기재
AI Management Processor탑재

폼팩터

카드 크기2.7인치(H) x 6.6인치(L)
미터법 환산약 68.6mm x 167.6mm
슬롯 폭듀얼 슬롯
높이 규격하프 하이트 (로우 프로파일)
냉각 방식액티브 (팬 내장)

디스플레이·비디오

디스플레이 출력Mini DisplayPort 2.1b 4개
최대 동시 디스플레이 (4K)3840 x 2160 @ 165Hz 4대
최대 동시 디스플레이 (8K)7680 x 4320 @ 100Hz 2대
인코더(NVENC)9세대 2개
디코더(NVDEC)6세대 2개
4:2:2 10비트 인코딩·디코딩지원

자주 묻는 질문

구매 담당자가 실제로 묻는 것들입니다.

가격은 얼마인가요?

구성과 수량, 서버 동시 구매 여부에 따라 달라지므로 별도 문의로 안내드립니다. 장착하실 섀시의 라이저 규격을 알려주시면 호환 여부와 함께 회신드립니다.

풀사이즈 RTX PRO 4000과 성능 차이가 어느 정도인가요?

CUDA 코어 수(8,960개)와 메모리 용량(24GB GDDR7 ECC)은 같지만 나머지가 다릅니다. NVIDIA 공식 수치 기준 FP32는 24 TFLOPS 대 40 TFLOPS, RT 코어는 73 TFLOPS 대 122 TFLOPS, AI는 770 TOPS 대 1,290 TOPS이며 메모리 대역폭은 432GB/s 대 672GB/s입니다. 전력이 70W와 140W로 두 배 차이 나는 데서 오는 격차입니다.

1U 랙 서버에 들어가나요?

높이는 2.7인치 하프 하이트라 맞지만 두께가 듀얼 슬롯이라는 점이 문제입니다. 1U 로우 프로파일 라이저는 대개 한 칸 폭만 제공하므로 실제로는 2U 이상 섀시나 소형 워크스테이션이 대상이 됩니다. 사용하실 섀시의 라이저 카드 사양을 확인해 드릴 수 있습니다.

보조 전원 케이블이 필요한가요?

NVIDIA 공식 사양표에는 보조 전원 커넥터 항목이 없고 총 보드 전력이 70W로 기재되어 있습니다. 다만 라이저를 경유하는 구성에서는 슬롯을 통해 실제로 공급되는 전력이 섀시마다 다를 수 있으므로, 서버 라이저 사양에서 슬롯당 공급 전력을 확인하시는 것을 권합니다.

PCIe x8인데 성능 손해가 있나요?

PCIe Gen5 x8은 Gen4 x16과 같은 대역폭이므로 대부분의 추론·렌더링 워크로드에서는 실질 제약이 크지 않습니다. 다만 호스트 메모리와 GPU 사이 데이터 이동이 매우 잦은 전처리 중심 파이프라인이라면 x16을 쓰는 풀사이즈 제품이 유리합니다.

디스플레이 출력 단자가 일반 DisplayPort인가요?

Mini DisplayPort 2.1b 4개입니다. 일반 DisplayPort 모니터를 연결하려면 변환 케이블 또는 어댑터가 필요하므로 수량을 함께 산정하시는 편이 좋습니다.

함께 검토하는 제품

같은 분류에서 자주 비교됩니다.

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Server Edition

패시브 냉각 96GB 데이터센터 GPU

별도 문의

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Workstation Edition

600W 96GB 워크스테이션 플래그십

별도 문의

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition

300W로 낮춘 96GB 다중 장착형

별도 문의

NVIDIA

NVIDIA RTX PRO 5000 72GB Blackwell

72GB 단일 GPU, 300W 이중폭 Gen5 카드

별도 문의