확장 가능한 컴퓨팅을 위한 최고의 워크스테이션 GPU인 NVIDIA RTX PRO™ 6000 Blackwell Max-Q 워크스테이션 에디션으로 전례 없는 확장성과 성능을 경험해 보십시오. 96GB GDDR7 메모리를 탑재한 RTX PRO 6000 Max-Q는 전문가들이 방대한 데이터 세트, 복잡한 시뮬레이션, AI 강화 애플리케이션을 타의 추종을 불허하는 성능과 정확도로 처리할 수 있도록 지원합니다. 여러 개의 RTX PRO 6000 Max-Q GPU를 결합함으로써 사용자는 타의 추종을 불허하는 수준의 연산 성능, 메모리 용량 및 데이터 처리량을 달성할 수 있어, AI, 그래픽 및 연산 분야의 최신 기술이 요구되는 미션 크리티컬 애플리케이션에 이상적인 솔루션입니다. 데이터 과학 및 에이전트 기반 AI부터 전문 시각화 및 가상 제작에 이르기까지, RTX PRO 6000 Max-Q는 획기적인 발전을 이끌고 가능성의 한계를 넓히는 데 필요한 확장성, 신뢰성 및 혁신을 제공합니다..
최고의 성능을 추구하는 전문가들을 위해 설계된 NVIDIA RTX PRO 솔루션은 타의 추종을 불허하는 성능, 안정성 및 지원 서비스를 제공합니다. 모든 GPU는 다양한 설계, 엔지니어링 및 AI 워크플로우에 대해 엄격한 테스트를 거쳤으며, 엔터프라이즈용 드라이버를 통해 지속적으로 최적화됩니다. 광범위한 ISV 인증, 강력한 IT 관리 도구, 엔터프라이즈급 지원 서비스를 갖춘 RTX PRO 워크스테이션은 기업 환경 구축 및 미션 크리티컬 업무에 있어 신뢰할 수 있는 선택입니다.
NVIDIA Blackwell 아키텍처는 획기적인 AI, 레이 트레이싱 및 신경망 그래픽 기술을 결합하고, 성능과 메모리를 대폭 향상시켜 어디서나 최첨단 전문 크리에이티브, 디자인 및 엔지니어링 워크플로를 구동합니다. NVIDIA RTX PRO™ Blackwell 세대 GPU는 고성능, 실시간 레이 트레이싱, AI 가속 컴퓨팅 및 전문 그래픽 렌더링을 제공하는 가장 진보된 워크스테이션용 GPU입니다.
Blackwell 스트리밍 멀티프로세서(SM)는 차세대 CUDA 코어와 신경망 셰이더를 통합하여 AI 강화 그래픽 및 연산 성능의 새로운 기준을 제시합니다. 이전 세대 대비 최대 1.4배 향상된 FP32 처리량을 자랑하는 블랙웰 SM 아키텍처는 GPU당 최대 24,064개의 CUDA 코어로 확장되어, 산업용 시뮬레이션, 3D 모델링 및 레이 트레이싱 렌더링을 위한 최대 110 TFLOPS의 단정밀도 성능을 제공합니다. 향상된 뉴럴 셰이더는 AI를 프로그래밍 가능한 파이프라인에 직접 내장하여 RTX 메가 지오메트리 및 DLSS 4.0 멀티 프레임 생성과 같은 하이브리드 워크플로우를 가능하게 합니다. FP64, FP32, FP16 및 BF16 정밀도 모드 지원, 더 큰 L2 캐시, 더 높은 클럭 속도를 갖춘 Blackwell SM은 AECO, 제조 및 미디어 워크플로우를 위한 텐서 연산, 스파스 신경망 및 사실적인 렌더링을 가속화합니다. 이러한 통합 설계는 레이 트레이싱, AI 추론 및 컴퓨팅 작업 간의 원활한 동시 처리를 보장하여, 전문가들이 전례 없는 효율성으로 차세대 AI 강화 워크플로를 처리할 수 있도록 지원합니다.
5세대 텐서 코어는 신경망 훈련 및 추론에 필수적인 딥러닝 행렬 연산을 가속화합니다. 이 코어는 ‘세분화된 구조적 스파스성(Fine-Grained Structured Sparsity)’ 기능을 활성화했을 때 이전 세대 대비 3배 더 높은 처리량을 제공하여, 스파스 신경망에서 성능을 최적화합니다. 이 코어들은 TF32, BF16, FP16, FP8, FP6 데이터 유형은 물론, 처리량을 대폭 향상시키는 새로 추가된 FP4 지원을 포함한 혼합 정밀도 연산을 지원하여 유연한 AI 모델 개발을 가능하게 합니다. 독립적인 부동 소수점 및 정수 데이터 경로는 연산을 병렬화하고 작업을 처리함으로써 복잡한 워크로드를 간소화합니다. DLSS 4 멀티 프레임 생성 기능으로 강화되어 실시간 AI 렌더링과 고품질 콘텐츠 제작을 가능하게 합니다. 개발자에게 이는 이전 세대 대비 메모리는 2배, AI 처리 성능은 3배 향상된 워크스테이션을 통해, 기존 프레임워크와의 하위 호환성을 유지하면서 로컬 LLM 프로토타이핑, 산업 규모 추론, 차세대 AI 모델의 효율적인 배포를 가속화할 수 있는 전례 없는 역량을 의미합니다.
4세대 RT 코어는 이전 세대 대비 최대 2배 빠른 레이 트레이싱 성능을 제공하여, 물리적으로 정확한 그림자, 반사 및 굴절을 구현한 사실적인 장면 렌더링을 가능하게 함으로써 생생한 뉴럴 그래픽스를 구현합니다. RTX Mega Geometry와 같은 뉴럴 그래픽스 기반 기술을 통해 최대 100배 더 많은 레이 트레이싱 삼각형을 처리하여, 사실적이고 물리적으로 정확한 장면과 몰입감 넘치는 3D 디자인을 제작할 수 있습니다. 이 코어들은 산업용 등급의 정밀도를 위해 설계되어 프로토타이핑, 몰입형 3D 환경, M&E 콘텐츠 제작에 이상적이며, 반복 작업 주기를 획기적으로 단축하여 전례 없는 생산성 향상을 실현합니다. NVIDIA OptiX, Microsoft DXR, Vulkan 레이 트레이싱과 같은 API를 활용하는 애플리케이션과 연동되는 RTX PRO GPU 기반 시스템은 진정한 상호작용형 디자인 워크플로우를 지원하여 즉각적인 피드백을 제공함으로써 전례 없는 수준의 생산성을 보장합니다.
NVIDIA Blackwell GPU 아키텍처는 4:2:2 색차 샘플링 비디오에 대한 하드웨어 인코딩 및 디코딩 지원을 추가하여, 이 형식으로 작업할 때 상당한 성능 향상을 제공합니다. 이를 통해 전문가들은 대기 시간이나 프록시 파일 관리에 소요되는 시간을 줄이고, 다음 걸작을 완성하는 데 더 많은 시간을 할애할 수 있습니다. 4:2:2가 4:2:0보다 더 많은 색상 정보를 보존한다는 점은 특히 HDR 콘텐츠나 텍스트, 가는 선과 같은 미세한 디테일을 유지해야 하는 경우, 또는 컬러 그레이딩과 같이 소스 영상에 반복적으로 색상 보정이 이루어지는 워크플로우에서 큰 도움이 됩니다.
9세대 NVIDIA NVENC 엔진은 전문 비디오 애플리케이션의 비디오 인코딩 속도를 획기적으로 높이고 화질을 개선합니다. 4:2:2 H.264 및 HEVC 인코딩 지원이 추가되었으며, AV1 및 HEVC의 화질이 BD-BR PSNR 기준 5% 향상되었습니다. 또한, 추가 시간이 소요되지만 최상의 화질을 위해 5% 더 향상된 성능을 제공하는 새로운 AV1 초고화질(UHQ) 모드도 도입되었습니다. NVENC는 가장 까다로운 4K 또는 8K 비디오 인코딩 작업을 처리하여 그래픽 엔진과 CPU를 다른 작업에 할당할 수 있게 해줍니다. 이를 통해 전문 비디오 편집에서 8K/60의 비디오 인코딩이 가능합니다. RTX PRO GPU는 소프트웨어 기반 인코더의 중간(Medium) 프리셋과 동등한 화질을 제공하지만, 성능은 2배 더 빠릅니다.
6세대 NVIDIA NVDEC 엔진은 이전 세대 대비 최대 2배의 H.264 디코딩 처리량을 제공하며, 4:2:2 H.264 및 HEVC 디코딩을 지원합니다. 전문가들은 고품질 동영상 재생의 이점을 누리고, 동영상 데이터 수집 속도를 높이며, AI 기반의 고급 동영상 편집 기능을 활용할 수 있습니다. 하드웨어 가속 디코딩이 지원되는 비디오 코덱은 다음과 같습니다: MPEG-2, VC-1, H.264(AVCHD), H.265(HEVC), VP8, VP9 및 AV1 비디오 형식.
새롭게 개선된 GDDR7 메모리는 대역폭과 용량을 획기적으로 향상시켜 애플리케이션의 실행 속도를 높이고, 더 방대하고 복잡한 데이터셋을 처리할 수 있게 해줍니다. 96GB의 GPU 메모리를 통해 방대한 3D 및 AI 프로젝트를 수행하고, 대규모 VR 환경을 탐색하며, 더 큰 규모의 다중 애플리케이션 워크플로를 구동할 수 있습니다. GDDR7 메모리는 최대 2배의 메모리 대역폭을 제공하여 레이 트레이싱, 렌더링 및 AI 워크로드를 가속화합니다. RTX PRO GPU는 지연 시간에 민감한 전문 애플리케이션에서 가장 방대한 데이터 세트와 모델을 처리할 수 있도록 업계 최고 수준의 그래픽 메모리 용량을 제공합니다.
GDDR7 메모리의 오류 정정 코드(ECC)에 대한 네이티브 지원은 메인 메모리와 분리된 작은 영역을 ECC 비트용으로 사용하는 사이드밴드 ECC 방식을 통해, 성능 저하나 용량 오버헤드 없이 더 높은 데이터 신뢰성을 보장합니다. ECC 비트는 단일 비트 오류를 수정하거나 이중 비트 오류를 표시하는 데 사용됩니다. RTX PRO GPU는 워크스테이션에 대한 타협 없는 연산 정확도와 신뢰성을 유지하면서, 미션 크리티컬 애플리케이션의 엄격한 데이터 무결성 요구 사항을 충족할 수 있도록 지원합니다.
Max-Q 기술군의 최적화 기술을 적용한 RTX PRO 라인업은 고밀도 멀티 GPU 구성 시스템에서 효율성을 극대화하는 데 중점을 둔 폼 팩터 최적화 솔루션을 포함합니다. 예를 들어, RTX PRO 6000 Max-Q 워크스테이션 에디션은 오늘날의 멀티 GPU 지원 시스템에 RTX PRO 6000의 성능을 제공하여 고밀도 4x GPU 구성을 가능하게 하며, 이를 통해 책상 위 단일 워크스테이션에서 384GB의 GPU 메모리를 활용할 수 있습니다.
RTX PRO GPU는 PCI Express Gen 5를 지원하며, x16 연결 시 최대 64GB/초의 대역폭(PCIe Gen 4의 두 배)을 제공하여 AI 및 데이터 과학과 같은 데이터 집약적 작업에서 CPU 메모리와의 데이터 전송 속도를 높여줍니다. 더 빨라진 PCIe 성능은 GPU 직접 메모리 액세스(DMA) 전송 속도도 향상시켜, 비디오 지원 장치를 위한 GPUDirect를 통한 비디오 데이터 전송을 가속화하고 GPUDirect Storage를 통한 입출력 속도를 높여줍니다.
CPU에서 GPU로 GPU 컨텍스트 스케줄링 작업을 오프로드하여 병목 현상과 지연 시간을 줄이고, CPU를 중요한 작업(예: 데이터 처리, I/O 작업)에 할당함으로써 복잡한 워크플로우의 응답성을 향상시키는 동시에, 고성능이 요구되는 크리에이티브, 엔지니어링 또는 과학적 워크로드에 대한 GPU 활용도를 극대화합니다. AI 및 그래픽스 작업(예: AI 노이즈 제거, 실시간 물리 시뮬레이션)의 동시 처리를 최적화하여 Omniverse나 AI 기반 설계 소프트웨어와 같은 도구에서 워크플로우를 가속화함으로써, 더 빠르고 원활한 생산성을 제공합니다.
RTX PRO 6000 Blackwell Max-Q GPU는 다중 인스턴스 GPU(MIG) 가상화 및 GPU 분할 기능을 지원합니다. MIG 모드로 구성할 경우, RTX PRO 6000은 최대 4개의 GPU 인스턴스를 제공합니다. 강력한 오류 격리 기능을 통해 RTX PRO 6000 GPU를 안전하고 확실하게 분할할 수 있습니다.
픽셀 단위 선점 기능은 VR 모션 트래킹과 같은 시간에 민감한 작업을 더 효과적으로 지원하기 위해 보다 세밀한 제어를 제공합니다.
명령어 수준에서의 선점 기능은 컴퓨팅 작업에 대해 더 세밀한 제어를 제공하여, 장시간 실행되는 애플리케이션이 시스템 리소스를 독점하거나 시간 초과되는 것을 방지합니다.
DisplayPort 2.1b를 통해 전문가들은 8K 해상도에서 240Hz, 16K 해상도에서 60Hz로 고해상도 디스플레이를 구동하며, 타의 추종을 불허하는 선명한 화질과 성능을 경험할 수 있습니다. 대역폭이 확대되어 멀티태스킹 및 협업에 이상적인 원활한 멀티 모니터 구성이 가능하며, HDR 및 향상된 색상 심도 지원으로 비디오 편집, 3D 디자인, 생방송 등 정밀한 작업에 필요한 뛰어난 색상 정확도를 보장합니다. DP 또는 HDMI를 통해 DSC(Display Stream Compression)를 사용하여 카드당 최대 4대의 4K 디스플레이(165Hz) 또는 최대 2대의 8K 디스플레이(100Hz)를 지원합니다. 최고 링크 속도를 사용하려면 DP80LL 인증 케이블이 필요합니다.
특히 대형 와이드스크린 디스플레이가 주류를 이루는 오늘날, 단일 대형 디스플레이 또는 다중 디스플레이 환경에서 데스크톱 사용 경험을 전례 없이 세밀하게 제어하여 생산성을 높일 수 있습니다.
단일 시스템 내에서 8개의 GPU(두 개의 Sync 보드를 통해 연결)를 사용하여 최대 32대의 디스플레이2에 대한 화면 및 이미지 출력을 동기화함으로써, 고급 비디오 시각화 환경을 구축하는 데 필요한 시스템 수를 줄일 수 있습니다. 또는 Sync를 사용하여 단일 시스템을 넘어 여러 시스템에 걸쳐 수백 대의 디스플레이를 동기화하여 대규모 환경을 구축할 수 있습니다. RTX PRO Blackwell GPU(4000 시리즈 이상)를 RTX PRO Sync 애드인 카드와 함께 사용하면 가변 재생률(최대 1000Hz)의 추가적인 이점을 경험할 수 있습니다. VRR은 동기화된 디스플레이에서 재생률을 다양하게 조절하여 지연 시간이 짧은 영역에서 디스플레이가 신속하게 적응할 수 있도록 지원합니다.
단일 워크스테이션에서 최대 4개의 GPU와 16개의 디스플레이에 걸쳐 데스크톱과 애플리케이션을 원활하게 확장하면서도 완벽한 성능과 화질을 제공합니다. 이를 통해 Windows에서는 최대 16K x 16K, Linux에서는 최대 32K x 32K 해상도를 지원합니다. 이 구성에서 디스플레이를 동기화하려면 Mosaic을 RTX PRO Sync와 함께 사용할 수 있습니다.
각 프레임 잠금 커넥터는 프레임 잠금 케이블과의 연결을 견고하게 고정하는 자동 잠금 장치가 적용되어 있어, 안정적인 연결성과 최고의 생산성을 보장합니다.
3D 스테레오 하드웨어를 NVIDIA RTX PRO 그래픽 카드와 직접 동기화할 수 있는 전용 연결을 통해 스테레오 효과를 정밀하게 제어합니다.
NVIDIA App은 최대 8K 해상도의 데스크톱 화면 녹화, 최신 NVIDIA RTX Enterprise 드라이버 업데이트에 대한 자동 알림, 게임 기능 이용 등 다양한 생산성 도구 모음을 데스크톱 워크스테이션에 제공합니다. 이 애플리케이션은 여기에서 다운로드할 수 있습니다.
Caffe2, MXNet, CNTK, TensorFlow 등의 딥러닝 프레임워크는 훈련 시간을 획기적으로 단축하고 다중 노드 훈련 성능을 크게 향상시킵니다. cuDNN, cuBLAS, TensorRT와 같은 GPU 가속 라이브러리는 딥러닝 추론과 고성능 컴퓨팅(HPC) 애플리케이션 모두에서 더 높은 성능을 제공합니다. NVIDIA AI Workbench를 사용하여 오늘 바로 시작해 보세요. 몇 번의 클릭만으로 샘플 프로젝트를 실행하거나 나만의 환경을 구축할 수 있으며, 팀을 위한 원클릭 협업 기능도 완벽하게 지원됩니다. 배포 준비가 되면, NVIDIA AI Enterprise가 모든 규모의 배포를 위해 기업용으로 검증된 방대한 사전 학습 모델, 도구 및 지원 서비스를 제공합니다.
C/C++ 및 Fortran과 같은 표준 프로그래밍 언어와 OpenCL, OpenACC, Direct Compute와 같은 API를 네이티브로 실행하여 레이 트레이싱, 영상 및 이미지 처리, 전산 유체 역학(CFD) 등의 기술을 가속화합니다.
GPUDirect for Video는 불필요한 시스템 메모리 복사 및 CPU 오버헤드를 방지함으로써 GPU와 비디오 I/O 장치 간의 통신 속도를 높여줍니다.
시스템 가동 시간을 극대화하고, 대규모 배포를 원활하게 관리하며, 그래픽 및 디스플레이 설정을 원격으로 제어하여 효율적인 운영을 실현합니다.
1 2025년 3월 18일부터 NVIDIA Quadro Sync II라는 기존 명칭이 변경됩니다.
2 이 기능을 사용하려면 Linux 및 NVIDIA RTX Enterprise 드라이버 R387 이상이 필요합니다. GPU가 4개 이상인 경우 NVIDIA SLI 인증 시스템이 필요합니다.
3 NVIDIA 앱은 NVIDIA 제어판과 NVIDIA RTX Experience™ 앱을 하나로 통합합니다.
| 아키텍처 | NVIDIA 블랙웰 아키텍처 |
| CUDA 병렬 처리 코어 | 24,064 |
| NVIDIA 텐서 코어 | 752 |
| NVIDIA RT 코어 | 188 |
| 단정밀도 성능1 | 110 TFLOPS |
| AI 성능1 | 3511 AI TOPS2 |
| RT Core 성능1 | 333 TFLOPSS |
| GPU 메모리 | ECC 지원 96GB GDDR7 |
| 메모리 인터페이스 | 512-bit |
| 메모리 대역폭 | 1792 GB/s |
| 최대 전력 소비량 | 300W |
| 다중 인스턴스 GPU | Up to 4x 24GB Up to 2x 48GB Up to 1x 96GB |
| 그래픽 버스 | PCI Express 5.0 x16 |
| 디스플레이 커넥터 | DP 2.1 (4) |
| 폼 팩터 | 4.4” H x 10.5” L, FHFL, Dual Slot |
| 제품 무게 | 1.23 kg |
| 열 관리 솔루션 | 공랭식 |
| NVIDIA® 3D Vision® and 3D Vision Pro | 3핀 미니 DIN을 통한 전원 공급 |
| 프레임 락 | 호환 가능 (NVIDIA RTX PRO Sync 지원) |
| 전원 커넥터 | 1x PCIe CEM5 16-pin |
| NVENC | NVDEC | JPEG | 4x | 4x | 4x |
1 최대 클럭은 GPU 부스트 클럭을 기준으로 합니다.
2 스파시티(Sparsity) 기능을 적용한 FP4 이론적 최대 성능(TOPS).