NVIDIA Vera Rubin NVL72, согласно заголовку публикации NVIDIA Blog, задаёт новый ориентир эффективности для ИИ-задач: до 30 раз больше работы на ватт.

В публикации также приводятся данные OpenRouter: такие нагрузки используют в 15 раз больше токенов, чем простой чат-запрос. В качестве примера упоминается исследование компании для инвестиционного решения.

Практический смысл заявления — в оценке вычислительной эффективности не только по мощности оборудования, но и по объёму работы, который оно выполняет. Однако доступный пакет содержит лишь синопсис метаданных, поэтому методика расчёта и сопоставимые условия неизвестны.