OpenAI разрабатывает и внедряет методы мониторинга, чтобы изучать возможные отклонения в поведении внутренних кодирующих агентов. Эти методы включают в себя анализ реальных развертываний, что позволяет выявлять потенциальные риски и улучшать меры безопасности ИИ.

Мониторинг основан на использовании цепочки мышления, что позволяет более глубоко понимать поведение агентов и выявлять возможные отклонения. Этот подход помогает укреплять защитные меры и обеспечивать более безопасное взаимодействие с ИИ.