La empresa OpenAI publicó una tarjeta del sistema que detalla las medidas de seguridad integrales implementadas para el sistema GPT-5.1-Codex-Max. El documento se centra en la metodología de protección, dividiéndola en dos direcciones clave: el nivel del modelo mismo y el nivel del producto.

A nivel de modelo, los desarrolladores aplicaron un entrenamiento especializado para neutralizar tareas dañinas y ataques mediante inyección de indicaciones (prompts). El nivel de producto incluye mecanismos como el aislamiento de agentes en entornos aislados (sandbox) y la capacidad de configurar flexiblemente el acceso a la red.

Estos pasos están dirigidos a crear un entorno de ejecución de código controlado, donde los riesgos potenciales se limitan mediante soluciones arquitectónicas antes de que puedan afectar a sistemas o datos externos.