
Anthropic et OpenAI souhaitent intégrer des évaluateurs de sécurité indépendants au sein de leurs laboratoires d'IA. Les chercheurs saluent cet accès sans précédent, tel que rapporté par TechCrunch AI.
La question principale est de savoir si ces évaluateurs pourront agir de manière indépendante. Selon la source, la transparence et l'autonomie des auditeurs sont nécessaires pour une surveillance significative.
En tant que condition future, la source mentionne la réglementation. Le document présenté ne contient aucun détail sur la composition des évaluateurs, leurs pouvoirs, la durée de leur mandat ou les mécanismes de publication des résultats.
commentaire éditorial
Pourquoi c’est important
La conséquence probable est un renforcement de l'attention portée à la supervision interne du développement de l'IA et aux exigences de transparence. Le signal observable le plus proche serait la publication de règles spécifiques régissant le fonctionnement des évaluateurs ou des résultats des audits. Une incertitude substantielle demeure : la source ne révèle pas la structure du modèle de supervision et ne contient aucune déclaration primaire des entreprises.