Attack  ·  用語集

Cryptographic Context Injection

攻撃者が悪意のある指示を暗号化またはエンコードされたペイロード内に隠すジェイルブレーク技術。AI モデルの安全フィルター(通常はプレーンテキストをスキャンする)は、復号化して実行する前に有害なコンテンツを見ることがありません。ユーザーのクリックなしで大手チャットボットの入力と出力の両方の安全チェックを破ることが示されています。
これは、今日のセーフガードが 1 回限りのバグではなく、繰り返し可能なトリックで体系的にバイパスできることを証明しており、同様のフィルタリングを使用している AI 製品は、この種の攻撃に対して再テストする必要があることを意味しています。
ライブフィードで追跡 この概念が実際のAIセキュリティ・ガバナンスの動向でどう現れるかを確認。
フィードを開く →