根據英偉達官方博客,與GB300 NVL72相比,Vera Rubin NVL72系統在處理AI代理工作負載時,每兆瓦的吞吐量提高了30倍,並且每百萬Token的成本降低了35倍。這一性能提升對於電力受限的AI工廠至關重要,意味着在相同能耗下能完成更多代理工作,並顯著降低運營成本。英偉達通過SemiAnalysis AgentX工作負載測量了這些推理吞吐量數據,該工作負載包含真實的代理式編碼會話,保留了實際的上下文增長、工具調用和子代理生成。