에 따르면 1M AI News 에 의하면, NVIDIA 창업자 겸 CEO 인 황렌흔은 GTC 2026 행사에서 Vera Rubin 플랫폼의 본격 양산을 공식 발표했습니다. 이 플랫폼은 새로운 7종 칩을 통합하고 5가지 랙 시스템을 포용한, 올인원 AI를 위한 초급 컴퓨터로 설계되었습니다.
핵심 랙 Vera Rubin NVL72에는 72개의 Rubin GPU 및 36개의 Vera CPU가 통합되어 NVLink 6로 상호 연결됩니다. 이전 세대인 Blackwell 플랫폼과 비교하여 대규모 혼합 전문가 모델 학습에 필요한 GPU 수가 1/4로 감소했으며, 와트당 추론 처리량은 Blackwell의 10배에 달하며 토큰당 비용은 1/10로 감소했습니다.
다섯 가지 랙 시스템은 완전한 AI 공장 기반 시설을 구성합니다:
- Vera Rubin NVL72 GPU 랙
- Vera CPU 랙 (Vera CPU 256개, 전통 CPU의 2배 효율, 속도 50% 향상)
- Groq 3 LPX 추론 가속 랙
- BlueField-4 STX 저장소 랙 (AI 에이전트 키-값 캐시용으로 설계되어, 추론 처리량이 최대 5배 증가)
- Spectrum-6 SPX 이더넷 랙
전력 소비 관리 측면에서 NVIDIA는 DSX 플랫폼을 동시에 출시했습니다: DSX Max-Q는 고정 전력 한도 내에서 AI 기반 시설의 30%를 다중 배치 할 수 있으며, DSX Flex는 이전에 사용되지 않았던 100 기가와트의 유휴 전력망 용량을 활성화 할 수 있습니다.
AWS, Google Cloud, Microsoft Azure, Oracle Cloud, CoreWeave, Lambda, Nebius 등의 클라우드 서비스 제공업체와 Cisco, Dell Technologies, HPE, Lenovo, Supermicro 등의 시스템 제조업체는 올해 하반기에 Vera Rubin 제품을 출시할 예정입니다. Anthropic, Meta, Mistral AI 및 OpenAI는 이미 이 플랫폼을 사용하여 보다 대규모 모델을 학습할 것으로 명시했습니다.
황렌흔은 2025년부터 2027년까지 Blackwell 및 Vera Rubin 시스템 총 주문이 적어도 1조 달러에 이를 것으로 예측했다. 이는 지난해 GTC에서 발표된 5천 억 달러의 예측에 비해 두 배의 증가입니다.