OpenAI, en collaboration avec le Pacific Northwest National Laboratory, a présenté un nouveau benchmark nommé DraftNEPABench. Cet outil est conçu pour évaluer l'efficacité avec laquelle les agents basés sur l'intelligence artificielle peuvent accélérer le processus d'approbation fédérale des projets aux États-Unis.

Selon les données présentées, l'utilisation de telles technologies pourrait potentiellement réduire le temps de préparation des documents dans le cadre du National Environmental Policy Act (NEPA) jusqu'à 15 %. L'objectif principal de cette initiative est de moderniser les procédures d'examen des infrastructures grâce à l'automatisation des tâches routinières.

L'introduction de tels benchmarks marque une tentative d'intégrer des modèles linguistiques de pointe dans les processus administratifs publics. Cependant, les données actuelles reposent exclusivement sur la déclaration des partenaires, et une confirmation indépendante de l'efficacité fait encore défaut.