インド工科大学ボンベイ校(IIT Bombay)と Adobe Research の研究者らが、言語モデルが出力したテキストから元の指示を復元する逆変換言語モデルを作成した。著者らはこの手法を「Previous-Token Prediction」と名付けた。

The Decoder の概要によると、このアプローチは元のモデルの重みへのアクセスを必要とせず、さまざまなモデルで機能するという。同誌はこの復元精度を「ほぼ完璧」と表現している。

閉鎖的なシステム指示を使用する企業にとって、これはそのような設定が開示される潜在的なリスクを意味する。しかしながら、利用可能な資料は研究の全文ではなくメタデータと出版の概要に過ぎないため、実験条件や本手法の適用範囲は不明確なままである。