Les chercheurs de l'Institute for AI Safety au Royaume-Uni ont appliqué des méthodes psychométriques aux tests de sécurité populaires des modèles linguistiques.

Selon leur évaluation, ces tests ne mesurent pas une caractéristique unique et continue des modèles.

La suppression inconditionnelle des requêtes peut artificiellement augmenter l'évaluation de la sécurité tout en diminuant l'utilité pratique du modèle.