英伟达表示,其Vera Rubin NVL72系统在MLPerf Inference v6.1测试中首次亮相,在DeepSeek-R1和Qwen3-VL等基准测试中,吞吐量比GB300 NVL72最高提升3.7倍。此外,软件优化也使性能较v6.0提升高达1.6倍,GB300 NVL72在288个GPU配置下实现了99%的扩展效率。