엔비디아는 자사의 Vera Rubin NVL72 시스템이 MLPerf Inference v6.1 테스트에 처음 등장하여 DeepSeek-R1 및 Qwen3-VL과 같은 벤치마크에서 GB300 NVL72 대비 최대 3.7배 높은 처리량을 달성했다고 밝혔다. 또한 소프트웨어 최적화를 통해 v6.0 대비 성능이 최대 1.6배 향상되었으며, GB300 NVL72는 288개 GPU 구성에서 99%의 확장 효율성을 달성했다.