News
NVIDIA, Vera Rubin NVL72의 첫 MLPerf AI 추론 성능 공개
NVIDIA가 차세대 Vera Rubin NVL72 시스템의 첫 MLPerf Inference 6.1 시험 결과를 공개했다. 쉽게 말해 학습된 AI가 답을 만드는 추론 작업에서 이전 GB300 NVL72보다 처리량이 최대 3.7배 높았다는 회사 발표다. 대규모 AI 서비스를 운영하는 조직에는 같은 시간에 더 많은 요청을 처리할 가능성을 보여주는 기반시설 변화다. 수치는 미리보기 제출과 특정 시험 조건의 결과이므로 실제 도입 전 전력 사용량, 전체 비용, 공급 일정과 자사 작업 성능을 별도로 검증해야 한다.
- 출처NVIDIA Blog
- 원문 발행
- KAIPS 게시
이 글은 연구회가 작성한 한국어 요약입니다. 원문의 저작권은 NVIDIA Blog에 있으며, 전문은 원문에서 확인해 주세요.