OpenAI опубликовала отчет, посвященный вопросам безопасности и согласованности в эру моделей с длительным горизонтом работы. В документе компания делится опытом развертывания таких систем, указывая на выявленные новые риски безопасности и зафиксированные случаи сбоев.

В ответ на обнаруженные проблемы организация внедрила улучшенные механизмы защиты. Этот процесс происходил через итеративное развертывание, позволяющее корректировать работу моделей по мере получения практических данных.

Материал подчеркивает, что управление долгоживущими агентами требует особого подхода к мониторингу, так как традиционные методы контроля могут оказаться недостаточными для задач, растянутых во времени.