定義
新たに開示された攻撃により、外部者がAIモデルのプライベートな「内部推論」—通常、ユーザーから隠されている段階的なメモ—を復号化して読むことができるようになります。これは3つの最大規模のAIプロバイダーに同時に影響を与えており、この弱点が1社の誤りではなく、共有された設計パターンにあることを示しています。
なぜ重要か
企業は競争上の理由やIP保護の理由、ならびに安全性フィルタリングのために、隠された推論が隠されたままであることに依存しています。攻撃者がそれを読むことができれば、独自のロジックを抽出し、「目に見えないところで」行われることを意図していた安全性チェックを回避する方法を見つけることができます。