定義
審査済みのセキュリティ専門家が、実際の脆弱性を発見・検証するという特定の目的のために、安全性の保護措置を軽減したフロンティアAIモデルを使用できるようにする管理されたプログラム。アクセスは段階的かつ承認制であり、モデルの保護措置の緩和は認可された防御作業に限定され、一般的な使用には適用されない。これにより、サイバー対応可能なモデルを活用できる人々の範囲が広がりつつも、その力を重要インフラに対して広く解き放つことは防ぐ。
なぜ重要か
防御側は、欠陥が実際に存在することを証明できるモデルを必要としている。適切に管理されたアクセスにより、セキュリティチームはその能力を手に入れつつ、強力なモデルが悪用されるリスクを管理できる。