著名アナリストの郭明錤氏による最新の業界調査によると、NVIDIAはAI推論プリフィル高速化GPUプロジェクト「Rubin CPX」を再始動し、AI推論コストが高いプリフィル段階をターゲットに製品設計を大幅に調整しました。新バージョンのRubin CPXは、標準のRubin GPUに近い演算能力を持ち、単一カードの最大消費電力は2300ワット、168GBのHBM4メモリを採用しています。このプロジェクトは2027年第1四半期に生産を開始する予定で、専用ハードウェアとヘテロジニアスデプロイメントを通じて長文コンテキスト推論のコスト削減を目指しています。郭氏によると、現在、AI推論ワークロードの50%以上がプリフィルとKVキャッシュ構築に由来しているとのことです。