NVIDIA Developer Blog опубликовал материал о бенчмаркинге вывода больших языковых моделей с помощью AIPerf. В описании говорится о проверке скорости системы после запуска модели и получения ответов на запросы.

Практическая ценность темы связана с переходом от факта работоспособности к измерению производительности. Однако предоставленный источник содержит только метаданные и краткий синопсис, поэтому конкретные показатели, сценарии тестирования и выводы публикации остаются неизвестными.