定義
AI コーディングエージェントが自動的に実行するセットアップまたは設定ステップに悪意のある命令を隠す、新しいスタイルの攻撃。セーフティサンドボックスまたは人間の承認チェックが開始される前に実行されます。コードは AI の通常の推論中ではなく「スタートアップ」で実行されるため、標準的な AI ガードレールはそれを検出できません。
なぜ重要か
これは、AI コーディングエージェントが半自律的に動作することを許可する場合に組織が依存するセーフティの約束を無効にします。研究者らは、単一の自動化されたエクスプロイトで 7 つの主要なエージェントプラットフォーム全体でこれが機能することを示しました。