
De acordo com o título da publicação no NVIDIA Blog, a NVIDIA Vera Rubin NVL72 estabelece um novo marco de eficiência para tarefas de IA: até 30 vezes mais trabalho por watt.
A publicação também apresenta dados da OpenRouter indicando que tais cargas de trabalho consomem 15 vezes mais tokens do que uma simples solicitação de chat. Como exemplo, menciona-se um estudo corporativo para uma decisão de investimento.
O significado prático da declaração reside na avaliação da eficiência computacional não apenas pela potência do equipamento, mas pelo volume de trabalho que ele executa. No entanto, o pacote disponível contém apenas um resumo dos metadados, portanto, a metodologia de cálculo e as condições comparáveis permanecem desconhecidas.
comentário editorial
Por que importa
Se o indicador for confirmado em testes independentes, a eficiência por unidade de energia tornar-se-á um critério importante para tarefas de IA de múltiplas etapas. O próximo sinal a ser observado é a publicação da metodologia de comparação ou dos resultados de medições de terceiros. Uma incerteza substancial está relacionada ao fato de que atualmente está disponível apenas um resumo de uma única fonte.