NVIDIA Blog の見出しによると、NVIDIA Vera Rubin NVL72 は AI ワークロード向けの新しい効率性ベンチマークを設定し、ワットあたりの処理量を最大 30 倍に増加させます。

同ブログでは OpenRouter のデータを引用し、こうしたワークロードは単純なチャットクエリよりも 15 倍多くのトークンを消費すると述べています。事例として、投資判断のための企業調査が挙げられています。

この主張の実践的な意味は、ハードウェアの電力だけでなく、実行される作業量においても計算効率を評価する点にあります。しかし、入手可能なパッケージにはメタデータの概要のみが含まれており、計算方法や比較可能な条件は不明です。