NVIDIA informou sobre os resultados da Vera Rubin NVL72 na estreia no MLPerf Inference v6.1; no título do material, o sistema é descrito como líder em desempenho.

Na descrição de acompanhamento, a NVIDIA destaca três fatores da economia de inferência de IA: desempenho do sistema, dimensionamento eficiente da infraestrutura e otimização contínua de software. Segundo a fonte, maior desempenho permite gerar mais tokens e potencialmente obter mais receita.

O material disponível tem status metadata_only: é um resumo fornecido pela editora, não o texto completo da publicação. Números de testes, composições de comparação e condições de medição não são incluídos na fonte.