何が起きたか
2026年9月30日〜10月1日、OpenAIは組織的なキャンペーンの詳細を公開した(7月24日〜25日にピークを迎え、4,000以上のユーザーから約16,000件の抽出リクエストを記録。7月28日に完全に無効化。関連パターンに紐づく15,000以上のユーザーを特定)。このキャンペーンでは敵対的蒸留を用いて保護されたモデルの推論を抽出しており、コアオペレータークラスターはMoonshot AIに関連する個人に帰属された。OpenAIは新たな緩和策の展開、アカウントの禁止、他ユーザーの暗号化推論のリプレイ/復号を可能にする経路の閉鎖、推論を露出させる出力を保持できるストリーミング出力チェックの追加を発表した。
なぜ重要か
保護された推論トレースを直接標的とした大規模な敵対的蒸留作戦に関する初の公的・日付入り記録であり、後続リスク(セーフガードなしの模倣、デュアルユース能力の移転)にも言及している。また、クロスセッションの暗号化推論復号に関する研究を検証し、フロンティアラボにおける具体的なプラットフォーム強化の変更を促した——推論トレース保護に関するAI-SPM/モデルセキュリティバイヤーにとって重要なデータポイントである。
適用範囲
AIプラットフォームチームとモデルプロバイダーは、暗号化された推論トレースを敵対的ターゲット第1位として扱うべきである。推論露出面の棚卸し、抽出型プロンプト量に対する異常検知の追加、サードパーティ製モデルセキュリティツールの評価前にクロスセッション/クロスモデルのトレース代替可能性のレビューを行うこと。