|
|
|
 |
 |
| |
 |
제 목 :
[엔비디아] 베라 루빈 NVL72, 메가와트당 처리량 최대 30배 달성 |
 |
작성자 :
|
등록일 : 2026-09-16 오후 4:48:15 |
|
|
 |
 |
 |

엔비디아가 엔비디아 베라 루빈 NVL72(NVIDIA Vera Rubin NVL72)의 에이전틱 AI 성능 결과가 세미애널리시스 에이전트X(SemiAnalysis AgentX) 대시보드에 공개됐다고 밝혔다. 딥시크 V4 프로(DeepSeek V4 Pro) 모델에서 베라 루빈 NVL72는 엔비디아 GB300 NVL72 대비 메가와트당 처리량을 최대 30배 높였다.
세미애널리시스 에이전트X는 단일 요청 벤치마크가 아닌 실제 기록된 에이전틱 코딩 세션을 기반으로 추론 성능을 측정하며, 실제 컨텍스트 증가와 툴 호출 지연 시간, 하위 에이전트 생성 과정까지 그대로 반영한다.
에이전틱 워크로드는 추론 벤치마크가 그동안 측정해 온 요청-응답형 작업과 다른 구조를 가진다. 에이전트가 추론하고 툴을 호출하며 하위 에이전트를 생성하는 과정에서 한 번의 세션에 수십만 개의 입력 토큰이 누적될 수 있다. 이는 단순한 채팅 요청 대비 약 15배 많은 토큰을 사용하는 규모이며, 요청마다 입력과 출력 길이의 편차도 크다. 이러한 과정을 엔드투엔드로 측정하려면 에이전트의 전체 작업 경로를 기반으로 설계된 벤치마크가 필요하다. 에이전트X는 이러한 특성을 반영해, 다양한 모델과 시나리오에서 요청 단위 성능을 측정하는 MLPerf 추론(MLPerf Inference)과 같은 표준화된 벤치마크 체계를 보완한다.
|
|
 |
 |
| 덧글쓰기 |
 |
|
|
|
|
|
|
|
|
|
|