NVIDIA RTX 6000 Ada Generation 48GB 제품 이미지
NVIDIA · GPU

NVIDIA RTX 6000 Ada Generation 48GB

48GB ECC 메모리, 300W 듀얼슬롯 Ada 최상위

별도 문의구성·수량에 따라 견적이 달라집니다
메모리48GB GDDR6 ECC연산 코어CUDA 18,176 / Tensor 568전력300W (TBP)폼팩터듀얼 슬롯 풀 하이트인터페이스PCIe 4.0 x16NVLink미지원

제품 개요

핵심만 먼저 — 자세한 설명은 아래에서 펼쳐 볼 수 있습니다.

NVIDIA RTX 6000 Ada Generation은 Ada Lovelace 아키텍처 기반 프로페셔널 그래픽 카드 라인업의 최상위 모델입니다. 48GB GDDR6 ECC 메모리를 단일 카드에 탑재해, 워크스테이션과 서버 양쪽에서 대용량 데이터셋을 GPU 메모리 안에 올려두고 작업하는 용도를 전제로 설계됐습니다. NVIDIA는 이 제품을 데이터센터 전용 가속기가 아니라 ISV 인증을 받은 프로페셔널 비주얼 컴퓨팅 제품군에 배치하고 있으며, 주요 워크스테이션 제조사와 독립 소프트웨어 벤더의 검증을 거칩니다. 엑스디노드는 이 카드를 서버·워크스테이션 구성 부품으로 공급합니다.

메모리48GB GDDR6 ECC384-bit / 960GB/s. Ada 프로 라인업 최대 용량
연산 코어CUDA 18,176 / Tensor 5683세대 RT 코어 142개, FP32 91.1 TFLOPS
전력300W (TBP)CEM5 16-pin 보조 전원 1개 필요
폼팩터듀얼 슬롯 풀 하이트10.5in(266.7mm) 길이, 액티브 냉각
인터페이스PCIe 4.0 x16Gen5 슬롯 하위 호환 장착 가능
NVLink미지원다중 장착 시 카드당 48GB가 상한
개요 전체 읽기

연산 자원은 Ada Lovelace 아키텍처 기반 CUDA 코어 18,176개, 4세대 Tensor 코어 568개, 3세대 RT 코어 142개로 구성됩니다. 공식 데이터시트 기준 단정밀도(FP32) 연산은 91.1 TFLOPS, RT 코어 성능은 210.6 TFLOPS이며, Tensor 연산은 1,457.0 TFLOPS입니다. 다만 이 Tensor 수치는 FP8 데이터 형식에 희소성(sparsity) 기능을 적용했을 때의 실효 성능이고, 앞의 두 수치는 GPU Boost 클럭 기준 피크값이라는 점을 감안해 해석해야 합니다. 4세대 Tensor 코어는 FP8을 포함해 FP16, BF16, TF32, INT8, INT4를 가속하며, FP4는 Ada 세대가 아닌 후속 Blackwell 세대에서 도입된 형식이므로 지원하지 않습니다.

메모리는 384-bit 인터페이스에 960GB/s 대역폭을 제공하고 ECC를 지원합니다. 같은 Ada 라인업의 32GB·24GB 모델과 비교했을 때 용량과 대역폭 모두 상위에 있어, 배치 크기나 씬 복잡도가 커져 메모리에서 먼저 막히는 작업에 유리합니다. 시스템 인터페이스는 PCIe 4.0 x16이며, PCIe는 상하위 호환이므로 PCIe Gen5 슬롯을 갖춘 최신 서버에 장착해도 동작합니다. 이 카드는 NVLink를 지원하지 않으므로, 여러 장을 꽂더라도 메모리가 하나로 합쳐지지 않고 카드당 48GB가 상한이라는 점은 도입 전에 반드시 확인해야 할 제약입니다.

총 보드 전력은 300W이고 냉각 방식은 액티브입니다. 보조 전원은 PCIe CEM5 16-pin 커넥터 1개를 사용하며, NVIDIA 공식 전력 가이드라인 문서(DA-07261-001)에도 동일하게 300W / CEM5 16-pin으로 등재돼 있습니다. 서버 PSU에 16-pin 커넥터가 없다면 NVIDIA가 정의한 어댑터 규격을 써야 하는데, 8-pin 1개짜리 어댑터는 센스 핀이 150W로 고정돼 카드가 부팅하지 않으므로 PCIe 8-pin 2개 또는 CPU 8-pin 1개를 16-pin으로 변환하는 300W급 어댑터가 필요합니다. 물리 규격은 4.4인치(약 111.8mm) 높이에 10.5인치(약 266.7mm) 길이, 듀얼 슬롯 풀 하이트입니다.

서버 장착 관점에서 이 카드의 장점은 300W라는 전력과 듀얼 슬롯이라는 두께입니다. 엑스디노드가 취급하는 MSI·GIGABYTE·Advantech 서버 중 풀 하이트 듀얼 슬롯 PCIe x16 슬롯과 CEM5 16-pin 보조 전원을 확보할 수 있는 모델이면 장착 대상이 됩니다. Advantech는 자사 자료에서 2U SKY-6200과 4U SKY-640 V3에 RTX 6000 Ada를 4장까지 넣을 수 있고 GPU 합산 전력이 1,200W 수준이라 2,000W급 서버 PSU 범위 안에 들어온다고 밝히고 있습니다. 참고로 NVIDIA 전력 가이드라인상 600W급인 RTX 6000 Blackwell과 달리 이 카드는 300W이므로 600W 카드 기준의 전원·슬롯 설계가 필요하지 않습니다. 다만 액티브 냉각 카드라 랙 서버에 여러 장을 밀집 배치할 때는 흡기 온도와 카드 간 간격을 반드시 섀시 사양으로 확인해야 하며, 최종 지원 여부는 서버 모델별 GPU 지원 목록 기준입니다.

48GB 단일 메모리 공간이 필요한 중대형 모델의 파인튜닝과 로컬 추론, 대규모 씬의 실시간 레이트레이싱, 대용량 CAD 어셈블리와 CAE 해석을 다루는 조직에 적합합니다. 반대로 카드 한 장의 48GB로 감당이 안 되어 GPU 간 메모리 풀링이나 고속 인터커넥트가 필요한 대규모 분산 학습이라면 NVLink와 HBM을 갖춘 데이터센터 가속기 쪽이 맞고, 전면 흡기·후면 배기 구조에 패시브 카드만 허용하는 고밀도 랙 서버라면 데이터센터용 패시브 GPU를 검토하는 편이 설치 측면에서 안전합니다. 워크로드가 24~32GB 안에서 끝나고 대수를 늘려 처리량을 확보하는 구조라면 하위 RTX 5000 Ada나 RTX 4500 Ada가 전력·발열 대비 효율이 낫습니다.

상세 사양

제조사 공식 문서 기준입니다.

메모리

메모리 용량48GB GDDR6
메모리 인터페이스384-bit
메모리 대역폭960 GB/s
ECC(오류 정정 코드)지원

연산

아키텍처NVIDIA Ada Lovelace
CUDA 코어18,176개
Tensor 코어568개 (4세대)
RT 코어142개 (3세대)
단정밀도(FP32) 성능91.1 TFLOPS (GPU Boost 클럭 기준 피크)
RT 코어 성능210.6 TFLOPS (피크)
Tensor 성능1,457.0 TFLOPS (FP8, 희소성 적용 실효치)
지원 정밀도FP8 / FP16 / BF16 / TF32 / INT8 / INT4 (FP4 미지원)
컴퓨트 APICUDA 11.6, OpenCL 3.0, DirectCompute

인터페이스·전력

시스템 인터페이스PCIe 4.0 x16
총 보드 전력(TBP)300 W
보조 전원 커넥터PCIe CEM5 16-pin 1개
냉각 방식액티브(Active)
NVLink미지원

폼팩터

카드 크기4.4in(H) x 10.5in(L) / 약 111.8mm x 266.7mm
슬롯 폭듀얼 슬롯(2슬롯)
브래킷 높이풀 하이트(Full Height)

디스플레이·미디어·소프트웨어

디스플레이 출력DisplayPort 1.4a 4개
최대 동시 디스플레이4x 4096x2160@120Hz / 4x 5120x2880@60Hz / 2x 7680x4320@60Hz
인코더·디코더인코드 3개, 디코드 3개 (AV1 인코드·디코드 포함)
그래픽 APIDirectX 12, Shader Model 6.6, OpenGL 4.6, Vulkan 1.3
vGPU 소프트웨어NVIDIA vPC/vApps, NVIDIA RTX Virtual Workstation
기타 지원GPUDirect for Video, GPUDirect RDMA, Quadro Sync II 호환, HDCP 2.2, Mosaic
VR Ready지원

구성 예시와 활용

실제 도입 문의가 많은 방향입니다.

중대형 모델 파인튜닝 및 로컬 추론

48GB ECC 메모리와 FP8을 가속하는 4세대 Tensor 코어를 활용해, 단일 카드 메모리 안에서 처리 가능한 규모의 모델을 파인튜닝하거나 사내에 추론 서비스로 올리는 용도에 적합합니다. 데이터가 외부로 나가면 안 되는 조직이 온프레미스 서버에 올려 쓰는 구성에서 자주 선택됩니다. 다만 NVLink가 없으므로 카드당 48GB를 넘는 단일 모델은 분할 배치가 필요합니다.

실시간 레이트레이싱 렌더링과 버추얼 프로덕션

3세대 RT 코어 142개와 210.6 TFLOPS의 RT 성능으로 대규모 씬의 레이트레이싱 프리뷰와 최종 렌더링 시간을 단축합니다. 인코더 3개·디코더 3개에 AV1 인코드·디코드를 지원해 고해상도 영상 입출력이 많은 파이프라인에도 대응합니다. Quadro Sync II 호환과 Mosaic을 지원해 다중 디스플레이 동기화가 필요한 현장 구성에도 사용됩니다.

대용량 CAD 어셈블리 및 CAE 시뮬레이션

부품 수가 많은 어셈블리를 뷰포트에서 회전·단면 처리할 때 메모리 용량이 병목이 되는 경우가 많은데, 48GB 구성이 이 지점을 완화합니다. ECC를 지원해 장시간 해석 작업 중 메모리 오류로 결과가 틀어지는 위험을 줄입니다. NVIDIA RTX 프로페셔널 카드는 주요 설계·해석 소프트웨어 벤더의 인증 대상이라 검증된 드라이버로 운용할 수 있습니다.

vGPU 기반 다중 사용자 가상 워크스테이션

NVIDIA RTX Virtual Workstation과 vPC/vApps를 지원해, 한 대의 서버에 장착한 GPU를 여러 설계자에게 분할 제공하는 구성이 가능합니다. 48GB라는 용량 덕분에 사용자당 할당 프로파일을 넉넉하게 잡거나 동시 사용자 수를 늘리는 쪽으로 설계할 수 있습니다. 단 vGPU 사용 시 카드의 물리 디스플레이 출력은 비활성화됩니다.

자주 묻는 질문

구매 담당자가 실제로 묻는 것들입니다.

서버에 장착하려면 어떤 조건이 필요한가요?

풀 하이트 듀얼 슬롯 PCIe x16 슬롯과 CEM5 16-pin 보조 전원 300W 확보가 기본 조건입니다. 카드 길이가 10.5인치(약 266.7mm)라 섀시 내 GPU 영역 길이도 확인해야 합니다. PCIe 4.0 카드지만 Gen5 슬롯에도 하위 호환으로 장착됩니다. 액티브 냉각 카드이므로 다중 장착 시 흡기 온도와 카드 간 간격을 섀시 사양으로 검토해야 하며, 최종 지원 여부는 서버 모델별 GPU 지원 목록을 기준으로 확인해 드립니다.

여러 장을 NVLink로 묶어 메모리를 합칠 수 있나요?

불가능합니다. NVIDIA 공식 데이터시트에 NVLink 미지원으로 명시돼 있습니다. 여러 장을 장착해도 카드당 사용 가능한 메모리는 48GB가 상한이며, 카드 간 통신은 PCIe를 경유합니다. 단일 모델이 48GB를 넘어가면 모델 병렬화로 나누거나, NVLink와 HBM을 지원하는 데이터센터 가속기를 검토하는 편이 맞습니다.

서버 PSU에 16-pin 커넥터가 없는데 사용할 수 있나요?

NVIDIA가 정의한 변환 어댑터를 써야 합니다. 다만 PCIe 8-pin 1개를 16-pin으로 바꾸는 어댑터는 센스 핀이 150W로 고정되어 300W 카드가 부팅하지 않습니다. PCIe 8-pin 2개 또는 CPU 8-pin 1개를 16-pin으로 변환하는 300W급 어댑터가 필요하며, 해당 PSU 레일이 실제로 그 전류를 공급할 수 있는지도 함께 확인해야 합니다. 구성 단계에서 전원 설계를 같이 검토해 드립니다.

FP8이나 FP4 같은 저정밀도 추론이 되나요?

4세대 Tensor 코어가 FP8을 가속하며, FP16·BF16·TF32·INT8·INT4도 지원합니다. 데이터시트의 Tensor 성능 1,457.0 TFLOPS는 FP8에 희소성을 적용한 실효 수치입니다. FP4는 Ada 세대가 아닌 후속 Blackwell 세대에서 도입된 형식이라 이 카드에서는 지원하지 않습니다.

헤드리스 서버에서 쓰는데 디스플레이 출력이 문제가 되나요?

DisplayPort 1.4a 4개가 있고 기본적으로 활성 상태이지만, 모니터를 연결하지 않아도 연산 용도로 사용하는 데는 문제가 없습니다. 다만 vGPU 소프트웨어를 사용할 경우 디스플레이 포트는 비활성화된다고 NVIDIA가 명시하고 있으므로, 가상 워크스테이션 구성과 물리 출력을 동시에 쓸 계획이라면 사전에 정리가 필요합니다.

가격은 얼마인가요?

엑스디노드는 전 제품 별도 문의 정책입니다. 카드 단품인지 서버 포함 구성인지, 장착 수량, 전원·냉각 옵션, 보증 조건에 따라 금액이 달라집니다. 사용하실 워크로드와 서버 모델을 알려주시면 구성안과 함께 안내해 드립니다.

함께 검토하는 제품

같은 분류에서 자주 비교됩니다.

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Server Edition

패시브 냉각 96GB 데이터센터 GPU

별도 문의

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Workstation Edition

600W 96GB 워크스테이션 플래그십

별도 문의

NVIDIA

NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition

300W로 낮춘 96GB 다중 장착형

별도 문의

NVIDIA

NVIDIA RTX PRO 5000 72GB Blackwell

72GB 단일 GPU, 300W 이중폭 Gen5 카드

별도 문의