[사진=엔비디아 제공]
[아이티비즈 김문구 기자] 엔비디아가 인터랙티브 AI 추론 가속기인 엔비디아 그록 3 LPX(NVIDIA Groq 3 LPX)의 양산에 들어갔다고 25일 발표했다.
엔비디아 베라 루빈(Vera Rubin) 플랫폼을 확장하는 그록 3 LPX는 반응성이 뛰어난 에이전틱 시스템의 초고속 토큰 생성을 지원해 AI 추론 성능을 크게 향상시킨다.
베라 루빈 NVL72 시스템은 모든 AI 팩토리를 위한 가장 다재다능한 학습 및 추론 플랫폼을 제공한다. 엔비디아 그록 3 LPX는 토큰 생성 속도를 획기적으로 높여 베라 루빈 NVL72의 추론 성능을 확장하며, 대량의 컨텍스트를 처리하는 워크로드에 최상의 사용자 경험을 제공한다. 이를 통해 에이전트가 극한의 속도로 작동할 수 있도록 지원한다.
엔비디아 그록 3 LPX는 AI 추론의 한계를 확장하고 있다. 그록 3 LPX는 오픈소스 에이전틱 모델 젬마 4 31B(Gemma 4 31B)를 대상으로 에이전틱 시스템에 필수적인 10만 토큰 컨텍스트를 적용한 아티피셜 애널리시스(Artificial Analysis) 벤치마크에서 초당 3,400개의 출력 토큰이라는 기록적인 성능을 달성했다. 이는 해당 모델에서 지금까지 기록된 가장 빠른 성능이다.
그록 3 LPX는 코딩과 같은 에이전틱 작업을 몇 시간이 아닌 단 몇 분 만에 수행할 수 있도록 지원하며, 가장 유사한 대체 플랫폼 대비 에이전트와 지연 시간에 민감한 워크로드에서 4배 빠른 응답 속도를 제공한다.
엔비디아 창립자 겸 CEO 젠슨 황은 “베라 루빈은 에이전틱 AI 시대를 위해 워크로드에 최적화된 AI 팩토리 구성으로 이러한 비전을 확장하며, 초고속 토큰 생성을 위한 LPX로 성능의 한계를 한층 더 끌어올린다"며 "이는 지능이 생산되는 방식을 혁신하며, 전 세계적으로 AI 컴퓨팅 수요가 증가하는 가운데 AI 처리량, 효율성, 응답성 측면에서 또 한 번의 획기적인 도약을 가능하게 한다”고 말했다.

![3, 2, 1 발사!…누리호, 우주로 날아올랐다 [지금은 우주]](https://image.inews24.com/v1/6684e88bd0fd0c.jpg)
![[콘텐츠 핫&뉴] ‘제우스:오만의 신’ 길드 전용 공간 추가](https://pimg.mk.co.kr/news/cms/202610/07/news-p.v1.20261007.80685af1417e4481b3375b49ef9876ae_R.jpg)


![[율곡로] 한국 공권력 우습게 본 중식당 테러](https://img0.yna.co.kr/etc/inner/KR/2026/10/07/AKR20261007088100546_01_i_P4.jpg)










English (US) ·