컴퓨팅
Supermicro, NVIDIA Vera Rubin NVL72 랙을 DLC-2 냉각과 함께 출하

Super Micro Computer, Inc. (SMCI ) 2026년 9월 23일 발표에, 이제 NVIDIA Vera Rubin NVL72 랙을 회사의 Data Center Building Block Solutions(DCBBS)와 DLC-2 직접 액체 냉각 스택과 통합하여 출하하고 있다고 밝혔다.
캘리포니아 주 산호세에 본사를 둔 이 회사는 DCBBS가 이제 Vera Rubin NVL72 배치를 위한 온라인 전환 시간을 단축하기 위해 모든 핵심 컴퓨팅 인프라를 지원하며, 현장 조사, 프로젝트 설계, 통합, L11 및 L12 테스트, 현장 배포 및 지속적인 지원을 담당하는 단일 팀을 제공한다고 밝혔습니다.
랙 구성 및 액체 냉각
각 NVL72 랙은 72개의 NVIDIA Rubin GPU와 36개의 NVIDIA Vera CPU를 단일 액체 냉각 랙에 결합하여 하나의 머신으로 동작합니다. 1U 컴퓨트 트레이 18개 각각은 Rubin GPU 4개와 Vera CPU 2개를 탑재하며, 9개의 6세대 NVIDIA NVLink 스위치 트레이를 통해 216 TB/s의 스케일업 대역폭을 제공합니다. 각 랙은 20.7 TB의 HBM4 메모리와 최대 54 TB의 LPDDR5X 메모리를 제공합니다.
출하 구성에는 1.8 MW 정격의 Supermicro 인‑로우 냉각 배분 유닛이 CDU당 N+1 이중화로 배치되며, 잔여 열 부하를 포집하기 위한 선택적 후면 도어 열교환기도 포함됩니다. Supermicro는 또한 NVIDIA 레퍼런스 아키텍처 기반의 네트워킹 통합 및 케이블링 서비스를 제공하여 AI 컴퓨트 패브릭, 컨버지드 패브릭 및 관리용 밴드 외 케이블링을 포함합니다.
보도자료에 따르면 Vera Rubin 플랫폼은 직접 액체 냉각과 함께 설계되었으며, 더 높은 AI 연산량이 전체 유체 배분 루프를 통해 열 부하를 이동시켜야 하기 때문입니다(냉각 플레이트에서 매니폴드, 냉각 타워까지). Supermicro는 전체 액체 냉각 스택으로 각 랙을 테스트하고 검증하며, 이를 통해 배포 시 온라인 전환 시간이 단축된다고 밝혔습니다. 회사의 사내 액체 냉각 포트폴리오는 냉각 플레이트, 매니폴드, 호스 키트, 랙 전원 선반, 인‑로우 및 인‑랙 CDU, 액체‑공기 사이드카 CDU, 후면 도어 열교환기, 시설 측 냉각 타워 등을 포괄합니다.
“우리는 수년간 액체 냉각 스택, 제조 능력, 그리고 바로 이 순간을 위한 배포 팀을 구축해 왔습니다.”라고 Supermicro의 사장 겸 CEO인 Charles Liang이 말했습니다. “우리 고객은 이제 확장형 유닛을 주문하고, 냉각 플레이트와 냉각 타워 사이의 모든 계층을 설계·구축함으로써 엔드‑투‑엔드 통합이 된 생산 준비 시스템을 받을 수 있습니다.”
확장형 유닛 및 배포 청사진
Supermicro의 DCBBS 청사진은 5 MW에서 기가와트 규모까지의 전력 범위에 대한 균형 잡힌 자재 명세서를 정의합니다. 하나의 Vera Rubin NVL72 확장형 유닛을 기반으로 한 청사진은 16개의 컴퓨트 랙에 걸쳐 1,152개의 NVIDIA Rubin GPU와 331 TB의 HBM4 메모리를 제공하며, 균형 잡힌 냉각 용량, 전력 공급, 고성능 스토리지, 컨텍스트 메모리 스토리지 및 네트워킹을 포함합니다. 전담 Supermicro 팀이 현장 조사, 설계, 통합, 테스트, 납품, 배포 및 지속적인 지원까지 각 프로젝트를 관리합니다.
그 Vera Rubin 제품 페이지에서 Supermicro는 각 Rubin GPU가 288 GB의 HBM4 메모리를 탑재하고, DLC-2 스택이 98+%의 열 포집 효율을 달성한다고 명시합니다. 회사는 NVL72 확장형 유닛을 랙당 227 kW, 1 MW 냉각 타워와 함께 규모를 설정했으며, 5 MW 전력 범위당 1,152 GPU와 864 TB의 LPDDR5X CPU 메모리를 결합합니다. 해당 페이지는 구성에 NVIDIA의 Context Memory Storage Platform, Spectrum-X Ethernet, Quantum-X800 InfiniBand가 지원되며, Supermicro의 SuperCloud 소프트웨어 제품군을 통해 인프라 제어, 배포 자동화 및 다중 테넌트 GPU 클라우드 관리를 수행한다고 밝힙니다. 또한 Supermicro는 페이지에 2U HGX Rubin NVL8 시스템 및 최대 256개의 액체 냉각 Vera CPU를 탑재한 Vera CPU 랙 등 관련 Vera Rubin 시스템을 나열합니다.
그 Vera Rubin NVL72 페이지에서 NVIDIA는 시스템이 72개의 Rubin GPU, 36개의 Vera CPU, ConnectX-9 SuperNIC 및 BlueField-4 DPU를 3세대 MGX NVL72 랙 설계에 통합하고, 80개가 넘는 MGX 생태계 파트너의 지원을 받는다고 설명합니다. NVIDIA의 사양 표에는 1,400 TB/s의 대역폭을 갖는 20.7 TB HBM4 메모리, 65 TB/s NVLink-C2C 대역폭, 3,168개의 맞춤형 Olympus CPU 코어, 최대 54 TB LPDDR5X, 32.4 TB/s 스케일‑아웃 네트워킹 대역폭, 그리고 45°C 입구 온도가 명시되어 있습니다.
NVIDIA는 NVL72가 백만 토큰당 비용을 1/10로 낮추고, 메가와트당 토큰 수를 최대 10배 증가시킨다고 주장하며, GB200 NVL72 대비 에이전트 추론 워크로드에서 GPU 수를 1/4로 줄여 혼합 전문가 모델을 학습할 수 있다고 합니다. 비교 근거는 페이지에 공개되어 있으며, NVIDIA는 성능 수치는 변동될 수 있음을 언급했습니다.
2026년 5월 31일 발표 타이베이 GTC에서 NVIDIA (NVDA ) 는 Vera Rubin이 전면 생산 단계로 가속화되고 있음을 발표했으며, 시스템 구축업체로 Supermicro를 전면 생산 시스템 구축업체 및 DSX AI 팩토리 플랫폼 채택 업체 중 하나로 명시하고, 생산 출하가 가을부터 시작될 예정이라고 밝혔습니다. NVIDIA는 Vera Rubin을 30개 국가의 350개가 넘는 공장에서 5랙 POD 규모 플랫폼으로 확대하고 있으며, 이전 세대 Grace Blackwell 플랫폼 대비 규모에서 10배의 에이전트 처리량을 제공한다고 주장했습니다.












