NVIDIAの公式ブログによると、Vera Rubin NVL72システムは、GB300 NVL72と比較して、AIエージェントのワークロードを処理する際に、1メガワットあたりのスループットが30倍向上し、100万トークンあたりのコストが35倍削減されます。この性能向上は、電力に制約のあるAI工場にとって極めて重要であり、同じエネルギー消費量でより多くのエージェント作業を完了できることを意味し、運用コストを大幅に削減します。NVIDIAは、SemiAnalysis AgentXワークロードを使用してこれらの推論スループットデータを測定しました。このワークロードには、実際のコンテキストの増加、ツール呼び出し、サブエージェントの生成を保持する実際の代理コーディングセッションが含まれています。