La société OpenAI a publié une fiche système détaillant les mesures de sécurité complètes mises en œuvre pour le système GPT-5.1-Codex-Max. Le document se concentre sur la méthodologie de protection, en la divisant en deux axes clés : le niveau du modèle lui-même et le niveau du produit.

Au niveau du modèle, les développeurs ont appliqué un entraînement spécialisé pour neutraliser les tâches nuisibles et les attaques par injection d'instructions. Le niveau produit inclut des mécanismes tels que l'isolement des agents dans un bac à sable (sandbox) et la possibilité de configurer flexiblement l'accès réseau.

Ces étapes visent à créer un environnement d'exécution de code contrôlé, où les risques potentiels sont limités par des solutions architecturales avant qu'ils ne puissent affecter les systèmes ou les données externes.