Según el titular de la publicación de NVIDIA Blog, NVIDIA Vera Rubin NVL72 establece un nuevo punto de referencia de eficiencia para tareas de IA: hasta 30 veces más trabajo por vatio.

La publicación también cita datos de OpenRouter: dichas cargas de trabajo utilizan 15 veces más tokens que una simple solicitud de chat. Como ejemplo, se menciona un estudio corporativo para una decisión de inversión.

El significado práctico de la afirmación reside en evaluar la eficiencia computacional no solo por la potencia del hardware, sino por el volumen de trabajo que este realiza. Sin embargo, el paquete disponible contiene únicamente un sinopsis de metadatos, por lo que la metodología de cálculo y las condiciones comparables son desconocidas.