
The Decoder によると、OpenAI は次期モデル「Astra」を、同社初の「重要な」サイバー能力を持つシステムとして評価している。監視のため、OpenAI はモデルの推論チェーン(思考の連鎖)を追跡する計画である。
この報道における問題は、推論チェーンの観察がすでにモデルの実際の意思決定を信頼ablyに反映するものではないと見なされている点にある。The Decoder によれば、Astra の新しいアーキテクチャは、推論のさらに大部分を読み取り不可能な領域に移行させるという。
これは、システムの能力が増大する一方で、監視体制が弱まる可能性を意味する。ただし、提示された資料は完全な記事本文や独立した確認ではなく、メタデータの要約に過ぎないため、OpenAI のアプローチの詳細やリスクの規模については不明確なままである。
編集部コメント
なぜ重要か
考えられる帰結として、Astra の安全性検証は、推論チェーンの読解に帰着しない方法により強く依存するようになる可能性がある。次に観測可能な兆候は、モデルの状況、「重要な」サイバー能力の基準、および追加の制御措置に関する OpenAI の公的な説明となるだろう。 существенная неопределённость(重大な不確実性)は、OpenAI の一次声明や完全な公開文書がなく、The Decoder によるメタデータの要約しか入手できない点にある。