NVIDIA RTX 4000 SFF Ada Generation 20GB 제품 이미지
NVIDIA · GPU

NVIDIA RTX 4000 SFF Ada Generation 20GB

보조 전원 없이 20GB를 쓰는 70W 듀얼 슬롯 카드

별도 문의구성·수량에 따라 견적이 달라집니다
메모리20GB GDDR6 ECC총 보드 전력70W연산 코어CUDA 6,144개폼팩터듀얼 슬롯미디어 엔진인코드 2 / 디코드 2vGPU미지원

제품 개요

핵심만 먼저 — 자세한 설명은 아래에서 펼쳐 볼 수 있습니다.

NVIDIA RTX 4000 SFF Ada Generation은 소형 폼팩터(SFF) 시스템을 겨냥해 나온 Ada Lovelace 기반 전문가용 카드다. 같은 이름을 쓰는 RTX 4000 Ada Generation과는 별개 제품으로, 코어 구성은 같지만 카드 형태와 전력 설계가 다르다. 높이 2.7인치의 듀얼 슬롯 카드이며 총 보드 전력이 70W로 묶여 있다. 전원 배선 없이 PCIe 슬롯 전원만으로 20GB급 전문가용 GPU를 넣어야 하는 자리를 위한 제품이다. 엑스디노드는 이 카드를 서버·워크스테이션 구성 부품으로 공급하며 가격은 구성에 따라 별도 문의로 안내한다.

메모리20GB GDDR6 ECC160비트 · 280GB/s
총 보드 전력70W보조 전원 커넥터 불필요
연산 코어CUDA 6,144개Tensor 192개 · RT 48개
폼팩터듀얼 슬롯2.7×6.6인치 · 액티브 냉각
미디어 엔진인코드 2 / 디코드 2AV1 인코드·디코드 지원
vGPU미지원VDI 분할 용도로는 불가
개요 전체 읽기

연산 구성은 3세대 RT 코어 48개, 4세대 Tensor 코어 192개, CUDA 코어 6,144개로 RTX 4000 Ada Generation과 동일하다. NVIDIA 데이터시트 기준 단정밀도 성능은 19.2 TFLOPS, RT 코어 성능은 44.3 TFLOPS이며 모두 GPU 부스트 클럭 기준 피크값이다. Tensor 성능은 306.8 TFLOPS로 표기되며 FP8 정밀도에 희소성을 적용한 실효값이다. 코어 수가 같은데 성능 수치가 낮은 것은 70W라는 전력 상한 안에서 클럭이 결정되기 때문이다. 미디어 엔진은 인코더 2개, 디코더 2개로 상위 카드와 동일하며 AV1 인코드·디코드를 모두 지원한다.

메모리는 20GB GDDR6에 160비트 인터페이스, 280GB/s 대역폭이고 ECC를 지원한다. 20GB라는 용량은 RTX 4000 Ada Generation과 같지만 대역폭은 360GB/s 대비 280GB/s로 낮다. 시스템 인터페이스는 PCIe 4.0 x16 전폭이며, 데이터시트상 NVLink는 지원하지 않는다. 실무에서 놓치기 쉬운 항목은 vGPU다. NVIDIA 데이터시트에 vGPU 소프트웨어 지원이 명시적으로 '아니오'로 적혀 있어 VDI 같은 가상 데스크톱 분할 용도로는 사용할 수 없다.

전력·설치 조건이 이 카드의 핵심 판단 요소다. 총 보드 전력은 70W이며, NVIDIA 워크스테이션 전원 가이드라인 문서에서 이 카드의 필수 보조 전원 커넥터는 '해당 없음(Not applicable)'으로 표기된다. 즉 PCIe 슬롯에서 공급되는 전력만으로 동작하므로 GPU 전원 케이블을 뽑을 필요가 없다. 카드 크기는 2.7인치(높이) × 6.6인치(길이) 듀얼 슬롯이고 냉각 방식은 액티브다. 슬롯 두 칸 폭을 쓰지만 높이가 낮아, 높이가 제한되는 섀시에서 자리를 만들기 쉬운 형태다.

서버 장착 관점에서 이 카드의 장점은 전원 배선이 아예 없다는 점이다. 600W급 데이터센터 GPU가 요구하는 이중폭 PCIe Gen5 슬롯과 CEM5 16핀 고전력 배선이 필요 없고, 상위 RTX 4000 Ada Generation과 달리 16핀 어댑터 확보 문제도 생기지 않는다. 대신 확인할 항목은 두 가지다. 첫째, 듀얼 슬롯 카드이므로 로우프로파일 슬롯 기준으로 두 칸 폭이 확보돼야 하고, 둘째, 데이터시트상 냉각 방식이 액티브라 패시브 GPU 전제로 설계된 랙 섀시에서는 지원 목록에서 빠질 수 있다. 엑스디노드가 취급하는 MSI·GIGABYTE·Advantech 서버 중 실제 장착 대상 모델은 모델별 GPU 지원 리스트로 확정하는 것을 권한다. 4개 출력이 모두 미니 DisplayPort라 콘솔이나 KVM 연결 시 어댑터가 필요한지도 함께 정리해 두는 편이 좋다.

이 카드가 맞는 자리는 전력과 공간이 함께 제한되는 환경이다. 슬림형 워크스테이션, 소형 엣지 노드, 전원 케이블을 늘리기 어려운 기존 섀시에 20GB급 GPU를 넣어야 하는 경우가 대표적이다. AV1 지원 인코더 2개·디코더 2개를 갖춰 영상 트랜스코딩이나 스트리밍 파이프라인에도 활용도가 있다. 반대로 같은 코어 구성에서 성능을 더 끌어내고 싶다면 130W·360GB/s의 RTX 4000 Ada Generation이 낫고, VDI처럼 vGPU 분할이 전제인 도입이라면 이 카드는 애초에 후보가 아니다. 16GB로 충분하고 PCIe x8 링크가 문제되지 않는다면 RTX 2000 Ada 쪽이 더 저부담 선택지다.

상세 사양

제조사 공식 문서 기준입니다.

메모리

GPU 메모리20GB GDDR6
메모리 인터페이스160비트
메모리 대역폭280GB/s
ECC(오류 정정 코드)지원

연산

아키텍처NVIDIA Ada Lovelace
CUDA 코어6,144개
Tensor 코어192개 (4세대)
RT 코어48개 (3세대)
단정밀도(FP32) 성능19.2 TFLOPS (GPU 부스트 클럭 기준 피크)
RT 코어 성능44.3 TFLOPS (GPU 부스트 클럭 기준 피크)
Tensor 성능306.8 TFLOPS (FP8 실효값, 희소성 적용 기준)
지원 정밀도FP8 지원 (4세대 Tensor 코어)

인터페이스·전력

시스템 인터페이스PCIe 4.0 x16
총 보드 전력(TGP)70W
보조 전원 커넥터불필요 (NVIDIA 전원 가이드라인상 '해당 없음')
NVLink미지원
vGPU 소프트웨어 지원미지원

폼팩터

카드 크기2.7인치(H) × 6.6인치(L)
슬롯 점유듀얼 슬롯
냉각 방식액티브 (카드 팬 내장)
디스플레이 출력미니 DisplayPort 1.4a × 4
최대 동시 디스플레이4096×2160 @120Hz 4대 / 5120×2880 @60Hz 4대 / 7680×4320 @60Hz 2대

미디어 엔진·소프트웨어

인코드/디코드 엔진인코드 2개, 디코드 2개
AV1인코드·디코드 지원
그래픽 APIDirectX 12, Shader Model 6.6, OpenGL 4.6, Vulkan 1.3
컴퓨트 APICUDA 11.6, OpenCL 3.0, DirectCompute
VR Ready지원
기타 기능GPUDirect for Video, GPUDirect RDMA, Quadro Sync II 호환, HDCP 2.2, Mosaic, 3D 스테레오 커넥터

자주 묻는 질문

구매 담당자가 실제로 묻는 것들입니다.

GPU 전원 케이블이 필요합니까?

필요하지 않습니다. 총 보드 전력이 70W이고, NVIDIA 워크스테이션 전원 가이드라인 문서(DA-07261-001_v17) Table 1에서 이 카드의 필수 보조 전원 커넥터가 '해당 없음(Not applicable)'으로 표기됩니다. PCIe 슬롯 공급 전력만으로 동작하므로 서버 PSU에서 별도 GPU 하네스를 뽑지 않아도 됩니다. 상위 RTX 4000 Ada Generation이 CEM5 16핀을 요구하는 것과 대비되는 지점입니다.

VDI 용도로 가상 분할해서 쓸 수 있나요?

불가능합니다. NVIDIA 데이터시트 사양표에 vGPU 소프트웨어 지원이 '아니오(No)'로 명시돼 있습니다. 다수 사용자에게 GPU를 나눠 주는 가상 데스크톱 구성이 목적이라면 vGPU를 공식 지원하는 제품군을 검토해야 합니다. 단일 사용자 또는 컨테이너 단위 전용 할당 방식으로는 정상 사용할 수 있습니다.

RTX 4000 Ada Generation과 코어 수가 같은데 왜 성능이 다릅니까?

CUDA 6,144개, Tensor 192개, RT 48개, 메모리 20GB GDDR6로 구성은 동일하지만 전력과 메모리 대역폭이 다릅니다. TGP 70W 대 130W, 메모리 대역폭 280GB/s 대 360GB/s이며, 그 결과 데이터시트 수치가 FP32 19.2 대 26.7 TFLOPS, RT 44.3 대 61.8 TFLOPS로 갈립니다. 같은 코어를 낮은 전력 상한 안에서 돌리기 때문에 나타나는 차이입니다.

디스플레이 출력이 미니 DisplayPort인데 일반 모니터에 연결됩니까?

출력은 미니 DisplayPort 1.4a 4개입니다. 일반 DisplayPort나 HDMI 모니터에 연결하려면 변환 어댑터 또는 케이블이 필요합니다. 최대 동시 디스플레이는 4096×2160 120Hz 4대, 5120×2880 60Hz 4대, 7680×4320 60Hz 2대까지 지원합니다. 연산 전용으로 헤드리스 운용하는 경우에는 출력 단자를 사용하지 않아도 됩니다.

1U 랙 서버에 들어갑니까?

카드 높이는 2.7인치, 길이는 6.6인치이지만 슬롯 점유가 듀얼 슬롯입니다. 라이저 구성상 두 칸 폭이 확보되는지 먼저 확인해야 합니다. 또한 데이터시트상 냉각 방식이 액티브(팬 내장)라, 패시브 GPU를 전제로 기류를 설계한 랙 섀시에서는 지원 목록에서 제외되는 경우가 있습니다. 대상 서버 모델을 알려주시면 GPU 지원 리스트를 확인해 회신드립니다.

가격은 얼마입니까?

엑스디노드는 전 제품 별도 문의 정책입니다. 수량, 함께 구성하는 서버 모델과 라이저 구성, 어댑터 포함 여부, 도입 시기에 따라 조건이 달라집니다. 필요한 구성을 알려주시면 견적으로 회신드립니다.

함께 검토하는 제품

같은 분류에서 자주 비교됩니다.

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Server Edition

패시브 냉각 96GB 데이터센터 GPU

별도 문의

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Workstation Edition

600W 96GB 워크스테이션 플래그십

별도 문의

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition

300W로 낮춘 96GB 다중 장착형

별도 문의

NVIDIA

NVIDIA RTX PRO 5000 72GB Blackwell

72GB 단일 GPU, 300W 이중폭 Gen5 카드

별도 문의