엔비디아가 인공지능(AI) 추론 전용 칩 ‘그록3 LPU’를 공개하며 AI 반도체 시장의 새로운 방향을 제시했다. 이번 발표는 단순한 성능 개선을 넘어 AI 에이전트 시대의 본격적인 시작을 알리는 기술적 전환점으로 평가된다.
그록3 LPU는 기존 GPU 중심 구조에서 나아가 AI 추론을 전담하는 역할을 수행한다. 이를 통해 AI 응답 속도와 처리 효율을 크게 향상시키는 것이 핵심 목표다.
GPU + LPU 구조로 처리 속도 혁신
엔비디아는 차세대 AI 시스템에서 GPU와 LPU의 역할을 분리하는 구조를 도입했다. GPU는 대규모 학습과 계산을 담당하고, LPU는 실제 사용자 요청 처리와 응답 생성 과정에서 핵심 역할을 수행한다.
이 구조는 AI 작업을 ‘프리필’과 ‘디코드’ 단계로 나누어 처리하는 방식으로 설계됐다. 이를 통해 전체 시스템의 처리 속도를 기존 대비 최대 35배까지 향상시킬 수 있다는 설명이다.
해당 기술은 차세대 AI 슈퍼컴퓨터 ‘베라 루빈’에 통합될 예정이며, AI 서비스의 실시간 처리 능력을 크게 끌어올릴 것으로 기대된다.
AI 추론 시장 경쟁 본격화
이번 발표는 AI 산업에서 ‘추론(inference)’ 영역의 중요성이 급격히 커지고 있음을 보여준다. 기존에는 학습(Training)이 핵심 경쟁력이었지만, 이제는 실제 서비스를 구동하는 추론 단계가 새로운 경쟁 축으로 떠오르고 있다.
엔비디아는 이를 통해 실시간 AI 서비스와 에이전트 기반 시스템 시장에서 지배력을 강화하려는 전략을 드러냈다.
삼성전자와 협력…AI 공급망 강화
그록3 LPU 생산에는 삼성전자와의 협력이 포함된 것으로 알려졌다. 이는 AI 반도체 산업에서 메모리와 제조 역량이 결합된 공급망 협력의 중요성을 보여주는 사례다.
AI 인프라 수요가 급증하는 상황에서 반도체 기업 간 협력 구조는 향후 시장 경쟁력의 핵심 요소로 작용할 가능성이 높다.
AI 에이전트 시대 본격화
그록3 LPU의 가장 큰 의미는 AI의 역할 변화다. 단순한 응답 생성 도구를 넘어 실제 업무를 수행하는 AI 에이전트 시대가 본격화되고 있다는 점이다.
AI가 실시간으로 사용자 요청을 처리하고 복잡한 작업을 수행하는 환경에서는 빠르고 효율적인 추론 성능이 필수적이다. LPU는 이러한 요구를 충족하기 위한 핵심 인프라로 자리 잡을 전망이다.
엔비디아는 AI 칩 시장 규모가 향후 급격히 성장할 것으로 전망하며, AI 인프라 경쟁이 더욱 가속화될 것이라고 밝혔다.
핵심 정리
• 엔비디아, AI 추론 전용 칩 ‘그록3 LPU’ 공개
• GPU와 LPU 분리 구조로 처리 속도 최대 35배 향상
• AI 추론 시장 경쟁 본격화
• 삼성전자와 협력 통한 공급망 강화

