엔비디아, '그록 3 LPX' 양산…AI 추론 성능↑

1 month ago 6
[사진=엔비디아 제공] [사진=엔비디아 제공]

[아이티비즈 김문구 기자] 엔비디아가 인터랙티브 AI 추론 가속기인 엔비디아 그록 3 LPX(NVIDIA Groq 3 LPX)의 양산에 들어갔다고 25일 발표했다.

엔비디아 베라 루빈(Vera Rubin) 플랫폼을 확장하는 그록 3 LPX는 반응성이 뛰어난 에이전틱 시스템의 초고속 토큰 생성을 지원해 AI 추론 성능을 크게 향상시킨다.

베라 루빈 NVL72 시스템은 모든 AI 팩토리를 위한 가장 다재다능한 학습 및 추론 플랫폼을 제공한다. 엔비디아 그록 3 LPX는 토큰 생성 속도를 획기적으로 높여 베라 루빈 NVL72의 추론 성능을 확장하며, 대량의 컨텍스트를 처리하는 워크로드에 최상의 사용자 경험을 제공한다. 이를 통해 에이전트가 극한의 속도로 작동할 수 있도록 지원한다.

엔비디아 그록 3 LPX는 AI 추론의 한계를 확장하고 있다. 그록 3 LPX는 오픈소스 에이전틱 모델 젬마 4 31B(Gemma 4 31B)를 대상으로 에이전틱 시스템에 필수적인 10만 토큰 컨텍스트를 적용한 아티피셜 애널리시스(Artificial Analysis) 벤치마크에서 초당 3,400개의 출력 토큰이라는 기록적인 성능을 달성했다. 이는 해당 모델에서 지금까지 기록된 가장 빠른 성능이다.

그록 3 LPX는 코딩과 같은 에이전틱 작업을 몇 시간이 아닌 단 몇 분 만에 수행할 수 있도록 지원하며, 가장 유사한 대체 플랫폼 대비 에이전트와 지연 시간에 민감한 워크로드에서 4배 빠른 응답 속도를 제공한다.

엔비디아 창립자 겸 CEO 젠슨 황은 “베라 루빈은 에이전틱 AI 시대를 위해 워크로드에 최적화된 AI 팩토리 구성으로 이러한 비전을 확장하며, 초고속 토큰 생성을 위한 LPX로 성능의 한계를 한층 더 끌어올린다"며 "이는 지능이 생산되는 방식을 혁신하며, 전 세계적으로 AI 컴퓨팅 수요가 증가하는 가운데 AI 처리량, 효율성, 응답성 측면에서 또 한 번의 획기적인 도약을 가능하게 한다”고 말했다.

Read Entire Article