
NVIDIA
NVIDIA RTX PRO 6000 Blackwell Server Edition
패시브 냉각 96GB 데이터센터 GPU

72W 싱글슬롯 로우프로파일 추론 GPU
핵심만 먼저 — 자세한 설명은 아래에서 펼쳐 볼 수 있습니다.
NVIDIA L4는 Ada Lovelace 아키텍처 기반의 저전력 데이터센터 GPU로, 이전 세대 T4의 후속에 해당한다. 72W라는 소비 전력과 하프하이트·하프렝스 싱글슬롯 폼팩터가 이 제품을 정의하는 특성이다. 이 목록의 다른 제품들이 이중폭·수백 와트급 카드인 것과 달리, L4는 범용 1U/2U 랙서버의 라이저에 여러 장 꽂아 쓰는 구성을 전제로 한다. AI 추론과 영상 처리, 가상 데스크톱을 낮은 전력 예산 안에서 처리하려는 조직이 주 대상이다.
| 전력 | 72W — 보조 전원 케이블 불필요 |
|---|---|
| 폼팩터 | 싱글슬롯 로우프로파일 — HHHL, 약 169mm x 69mm |
| 메모리 | 24GB GDDR6 — 192비트, 300GB/s |
| FP8 성능 | 485 TFLOPS — 희소성 적용 기준 |
| 영상 | NVDEC 4개 / NVENC 2개 — JPEG 디코더 4개, AV1 지원 |
| 밀도 | 서버당 최대 8장 — 8장 구성 시 GPU 총 576W |
연산 성능은 FP32 30.3 TFLOPS이며, Tensor Core는 희소성 적용 기준 TF32 120 TFLOPS, FP16과 BFLOAT16 각 242 TFLOPS, FP8 485 TFLOPS, INT8 485 TOPS를 낸다. Ada 세대이므로 FP8까지 지원하고 FP4는 지원하지 않는다. 미디어 엔진은 NVENC 2개, NVDEC 4개, JPEG 디코더 4개로 구성돼 있고 AV1 코덱을 지원한다. 디코더가 인코더보다 많다는 구성에서 알 수 있듯이 대량 영상 스트림 입력을 받아 AI로 분석하는 파이프라인에 무게가 실려 있다. GPU 클럭은 베이스 795MHz, 부스트 2,040MHz다.
메모리는 24GB GDDR6에 192비트 버스폭, 메모리 클럭 6,251MHz로 대역폭은 300GB/s다. 24GB는 7B~13B급 모델을 양자화해 올리거나 비전 모델을 다수 상주시키기에 적당한 용량이며, 그 이상 규모에는 부족하다. 인터페이스는 PCI Express Gen4 x16이고 Gen4 x8, Gen3 x16 모드로도 동작해 구형 서버와의 호환 폭이 넓다. NVLink와 MIG는 지원하지 않는 대신 SR-IOV와 vGPU 15.2 이상을 지원해 가상 데스크톱·가상 워크스테이션 형태의 분배가 가능하다. 디스플레이 출력 단자는 없으므로 화면 출력은 vGPU를 통한 원격 방식으로만 이뤄진다.
전력은 기본 72W, 최대 72W, 최소 40W다. 보조 전원 케이블이 필요 없어 PCIe 슬롯 전력만으로 동작하며, 이 점이 서버 구성에서 가장 큰 이점이다. 방열은 패시브이고 폼팩터는 하프하이트·하프렝스 싱글슬롯(HHHL-SS)으로 길이 약 169mm, 높이 약 69mm다. 보드 무게는 약 270g으로 가볍고, 풀하이트와 하프하이트 브래킷이 모두 제공돼 1U와 2U 섀시 양쪽에 대응한다.
서버 장착 조건이 이 목록에서 가장 완화돼 있다. 보조 전원 커넥터가 필요 없고 싱글슬롯이므로, 엑스디노드가 취급하는 MSI·GIGABYTE·Advantech 서버 중 GPU 전용 섀시가 아닌 범용 1U/2U 랙서버의 라이저 슬롯에도 장착할 수 있다. 한 서버에 1~8장 구성이 가능해 GPU 밀도를 슬롯 수만큼 올릴 수 있고, 8장을 채워도 GPU 총 전력이 576W 수준이라 기존 PSU 여유 안에서 소화되는 경우가 많다. 다만 패시브 방열인 것은 동일하므로 라이저 위치의 기류가 확보되는지, 서버 벤더의 GPU 지원 목록에 포함돼 있는지는 확인해야 한다. 낮은 전력과 짧은 길이 덕분에 엣지 사이트나 통신 캐비닛처럼 공간·전력이 제한된 환경에도 배치할 수 있다.
실시간 영상 분석, 대량 트랜스코딩, 소형·중형 모델의 추론 서빙, 가상 데스크톱, 엣지 AI 추론에 맞는다. 반대로 모델 학습이나 24GB를 넘는 모델 적재, FP64 계산이 필요하다면 이 제품으로는 감당되지 않으므로 L40S 48GB 이상 또는 H100·H200 계열을 검토해야 한다. 그래픽 렌더링 성능이 핵심이라면 RT 코어와 DisplayPort 출력을 갖춘 L40S가 더 맞는 제품이다. 서버 모델별 장착 가능 수량과 리드타임이 다르므로 엑스디노드로 별도 문의하면 확인해 드린다.
제조사 공식 문서 기준입니다.
| 메모리 용량 | 24GB |
|---|---|
| 메모리 종류 | GDDR6 (ECC 지원) |
| 메모리 대역폭 | 300GB/s |
| 메모리 버스폭 | 192비트 |
| 메모리 클럭 | 6,251MHz |
| MIG (분할) | 미지원 |
| 아키텍처 | NVIDIA Ada Lovelace |
|---|---|
| FP32 | 30.3 TFLOPS |
| TF32 Tensor Core | 120 TFLOPS (희소성 적용) |
| FP16 / BFLOAT16 Tensor Core | 각 242 TFLOPS (희소성 적용) |
| FP8 Tensor Core | 485 TFLOPS (희소성 적용) |
| INT8 Tensor Core | 485 TOPS (희소성 적용) |
| FP4 | 미지원 (Ada 세대) |
| GPU 클럭 | 베이스 795MHz / 부스트 2,040MHz |
| PCIe 인터페이스 | PCI Express Gen4 x16 (64GB/s), Gen4 x8·Gen3 x16 지원 |
|---|---|
| NVLink | 미지원 |
| 최대 소비전력 (TDP) | 72W (기본 72W, 최소 40W) |
| 보조 전원 커넥터 | 불필요 (슬롯 전력만으로 동작) |
| 디스플레이 출력 | 없음 |
| 폼팩터 | 하프하이트·하프렝스 싱글슬롯 (HHHL-SS) |
|---|---|
| 슬롯 폭 | 싱글슬롯 (1슬롯 로우프로파일) |
| 카드 크기 | 약 169mm x 69mm |
| 냉각 방식 | 패시브 (섀시 기류 필요) |
| 보드 무게 | 약 270g (브래킷 제외) |
| 브래킷 | 풀하이트·하프하이트 모두 제공 |
| 서버 구성 | 파트너 및 NVIDIA-Certified Systems, 1~8 GPU |
| 인코더 / 디코더 | NVENC 2개 / NVDEC 4개 / JPEG 디코더 4개 |
|---|---|
| AV1 지원 | 지원 |
| SR-IOV | 지원 |
| vGPU 소프트웨어 | vGPU 15.2 이상 |
| 드라이버 | Linux·Windows R525 이상 |
| Secure Boot | 지원 (Root of Trust) |
구매 담당자가 실제로 묻는 것들입니다.
가능성이 높습니다. 싱글슬롯 하프하이트·하프렝스 카드에 보조 전원 커넥터가 필요 없어 PCIe 슬롯 전력만으로 동작하므로, GPU 전용 섀시가 아닌 범용 1U/2U 랙서버 라이저에도 들어갑니다. 다만 패시브 방열이라 라이저 위치의 기류 확보와 서버 벤더의 GPU 지원 목록 등재 여부는 확인해야 합니다. 보유 서버 모델을 알려주시면 장착 가능 수량까지 확인해 드립니다.
메모리가 24GB GDDR6, 대역폭 300GB/s이므로 7B~13B급 모델을 양자화해 서빙하거나 비전·음성 모델을 여러 개 상주시키는 정도가 현실적인 범위입니다. 그 이상 규모의 모델이나 학습 워크로드에는 부족하므로 L40S 48GB 이상 또는 H100·H200 계열을 검토해야 합니다.
NVENC 인코더 2개, NVDEC 디코더 4개, JPEG 디코더 4개를 갖추고 AV1 코덱을 지원합니다. 디코더가 인코더보다 많은 구성이라 다수의 영상 스트림을 받아 디코딩한 뒤 AI 모델로 분석하는 파이프라인에 유리합니다. 트랜스코딩 위주라면 인코더 수를 기준으로 필요한 카드 수를 산정해야 합니다.
MIG 하드웨어 분할은 지원하지 않습니다. 대신 SR-IOV와 vGPU 15.2 이상을 지원하므로 가상 데스크톱이나 가상 워크스테이션 형태로 배분할 수 있습니다. 드라이버는 Linux·Windows 모두 R525 이상이 필요합니다.
Ada 세대 4세대 Tensor 코어로 FP8 정밀도를 지원하고 AV1 코덱이 추가된 것이 주된 차이입니다. 전력은 T4와 비슷한 저전력 싱글슬롯 대역을 유지하면서 메모리가 24GB로 늘어 모델 적재 여유가 커집니다. 기존 T4 슬롯을 그대로 활용하려는 경우 서버 벤더의 지원 목록 확인이 필요합니다.
구성과 수량, 서버 조합에 따라 달라져 별도 문의로 안내드립니다. 서버 한 대당 몇 장을 장착할 계획인지와 용도가 추론인지 영상 처리인지 알려주시면 구성안과 함께 제안드립니다.
같은 분류에서 자주 비교됩니다.

NVIDIA
패시브 냉각 96GB 데이터센터 GPU

NVIDIA
600W 96GB 워크스테이션 플래그십

NVIDIA
300W로 낮춘 96GB 다중 장착형

NVIDIA
72GB 단일 GPU, 300W 이중폭 Gen5 카드