NVIDIA сообщила о результатах системы Vera Rubin NVL72 на дебюте в тестах MLPerf Inference v6.1. В заголовке публикации система названа лидирующей по производительности.

В сопроводительном описании NVIDIA выделяет три фактора экономики вывода ИИ: производительность системы, эффективное масштабирование инфраструктуры и постоянную оптимизацию программного обеспечения. Более высокая производительность, по описанию источника, позволяет генерировать больше токенов и потенциально получать больше выручки.

Доступный материал имеет статус metadata_only: это синопсис, предоставленный издателем, а не полный текст публикации. Числа тестов, состав сравнения и условия измерений в источнике не приведены.