엔비디아가 CES 2026에서 차세대 AI 슈퍼컴퓨팅을 겨냥한 ‘엔비디아 루빈(NVIDIA Rubin)’ 플랫폼을 공개했다. AI 훈련과 추론 수요가 폭발적으로 증가하는 상황에서, 루빈은 단일 칩이 아닌 ‘완전한 AI 시스템 아키텍처’로 설계된 것이 핵심이다.

루빈 플랫폼은 총 6종의 신규 칩으로 구성되며, GPU·CPU·네트워크·보안·스토리지를 하나의 공동 설계(Co-design) 구조로 통합했다. 이는 AI 모델 학습 시간과 추론 토큰 비용을 동시에 낮추기 위한 전략적 접근이다.

구성 요소에는 베라(Vera) CPU, 루빈 GPU, NVLink 6 스위치, 커넥트X-9 슈퍼NIC, 블루필드-4 DPU, 스펙트럼-6 이더넷 스위치가 포함된다. 엔비디아는 이를 통해 세계 최대 규모의 AI 시스템을 더 낮은 비용과 높은 보안 수준으로 구현할 수 있다고 강조했다.

성능 측면에서 루빈 플랫폼은 에이전틱 AI, 고급 추론, 대규모 MoE(Mixture-of-Experts) 모델 처리에 최적화됐다. 엔비디아는 루빈이 블랙웰(Blackwell) 대비 토큰당 비용을 최대 10배 절감하고, MoE 모델 훈련에 필요한 GPU 수를 4분의 1 수준으로 줄일 수 있다고 밝혔다.

또한 루빈은 새로운 AI 네이티브 스토리지 개념인 ‘추론 컨텍스트 메모리 스토리지 플랫폼’을 도입했다. 이는 KV 캐시 데이터를 인프라 전반에서 공유·재활용해 대규모 추론 환경의 반응성과 전력 효율을 동시에 끌어올리는 구조다.

보안 측면에서는 블루필드-4 기반의 ASTRA(Advanced Secure Trusted Resource Architecture)를 적용해 멀티 테넌트·베어메탈 AI 팩토리 환경에서도 성능 저하 없이 강력한 격리와 제어를 가능하게 했다.

엔비디아는 루빈을 NVL72 랙 스케일 시스템과 HGX 루빈 NVL8 서버 플랫폼으로 제공하며, DGX SuperPOD를 통해 수백만 GPU 규모 AI 팩토리로의 확장까지 염두에 두고 있다.

 

인사이트

• 루빈은 단일 GPU 성능 경쟁을 넘어, AI 인프라 전체를 ‘엔비디아 표준’으로 묶으려는 전략의 정점이다.

• 토큰 비용 10배 절감과 GPU 요구량 감소는 초거대 AI 모델의 상용화 속도를 크게 앞당길 수 있다.

• 네트워크·스토리지·보안까지 포함한 공동 설계는 엔비디아가 더 이상 칩 회사가 아니라 ‘AI 팩토리 플랫폼 기업’으로 진화했음을 보여준다.

• 루빈의 등장은 클라우드, AI 스타트업, 빅테크 전반에서 인프라 재편과 투자 방향 변화를 촉발할 가능성이 크다.