何が起きたか
AI安全保障の非営利団体FAR.AIが(2026年7月29日)leaderboard.far.aiを立ち上げました。これはCBRNEとサイバードメインにおける60以上のジェイルブレイク技術に対するフロンティアモデルのセーフガードをテストする独立した公開ベンチマークで、モデル間で100倍以上のロバストネスギャップを発見し(Grok 4.5/Gemini 3.1 Pro は300ドル未満で破綻、Claude Fable 5/GPT-5.6 Sol は14,200ドルを上回る維持)、新しい「Minimal Standard for Safeguards v1.0」ベースラインも公開されました。
なぜ重要か
AI ジェイルブレイクロバストネスの最初の標準化された、ベンダー横断的な、コストベースのメトリクスを提供し、企業と規制当局にベンダーの自己報告に依存するのではなくフロンティアモデルの安全性主張を比較する独立した方法を与えます。
適用範囲
高リスクデプロイメント用のフロンティアモデルを選択・精査するCISO およびAIガバナンスチーム。AI安全性ベースラインを作成する政策立案者。