A OpenAI desenvolve e implementa métodos de monitoramento para estudar possíveis desvios no comportamento de seus agentes de codificação internos. Esses métodos incluem a análise de implantações reais, o que permite identificar potenciais riscos e melhorar as medidas de segurança de IA.

O monitoramento baseia-se no uso de cadeias de pensamento, o que permite compreender mais profundamente o comportamento dos agentes e identificar possíveis desvios. Essa abordagem ajuda a reforçar as medidas de proteção e garantir uma interação mais segura com a IA.