OpenAI gab bekannt, dass ChatGPT Methoden zum Schutz vor Prompt-Injection und Social Engineering einsetzt. Diese Methoden umfassen die Einschränkung riskanter Aktionen und den Schutz sensibler Daten in den Arbeitsprozessen der Agenten. Die Informationen zu diesen Schutzmaßnahmen wurden auf der offiziellen Website von OpenAI veröffentlicht.

Obwohl OpenAI Informationen über den Schutz bereitgestellt hat, basieren diese ausschließlich auf Metadaten, was ihre Zuverlässigkeit einschränkt. Es gibt keine zusätzlichen Quellen, die diese Behauptungen bestätigen. Dies bedeutet, dass die Informationen unvollständig sein oder einer weiteren Bestätigung bedürfen könnten.