NVIDIA Developer Blog a publié un article sur le benchmarking de l'inférence des grands modèles de langage à l'aide d'AIPerf. La description mentionne la vérification de la vitesse du système après le lancement du modèle et l'obtention de réponses aux requêtes.

La valeur pratique du sujet est liée au passage du simple fait de la fonctionnalité à la mesure de la performance. Cependant, la source fournie contient uniquement des métadonnées et un bref synopsis; par conséquent, les indicateurs spécifiques, les scénarios de test et les conclusions de la publication restent inconnus.