De acordo com o título da publicação no NVIDIA Blog, a NVIDIA Vera Rubin NVL72 estabelece um novo marco de eficiência para tarefas de IA: até 30 vezes mais trabalho por watt.

A publicação também apresenta dados da OpenRouter indicando que tais cargas de trabalho consomem 15 vezes mais tokens do que uma simples solicitação de chat. Como exemplo, menciona-se um estudo corporativo para uma decisão de investimento.

O significado prático da declaração reside na avaliação da eficiência computacional não apenas pela potência do equipamento, mas pelo volume de trabalho que ele executa. No entanto, o pacote disponível contém apenas um resumo dos metadados, portanto, a metodologia de cálculo e as condições comparáveis permanecem desconhecidas.