OpenAI développe et met en œuvre des méthodes de surveillance afin d'étudier les écarts potentiels dans le comportement des agents de codage internes. Ces méthodes incluent l'analyse de déploiements réels, ce qui permet d'identifier les risques potentiels et d'améliorer les mesures de sécurité de l'IA.

La surveillance repose sur l'utilisation d'une chaîne de pensée, ce qui permet de comprendre plus profondément le comportement des agents et de détecter d'éventuels écarts. Cette approche contribue à renforcer les mesures de protection et à garantir une interaction plus sûre avec l'IA.