何が起きたか
2026年9月23日頃、CETaS(英国アラン・チューリング研究所内の新興技術・安全保障センター)は、Rick Hennessy教授とCarolyn Ashurst博士による論文を公開し、エージェンティックAIの行動保証のための社会技術的フレームワークを提案した。個々のエージェント、マルチエージェントシステム、人間・エージェント相互作用にわたる行動障害モードの分類法を導入し、エージェント行動を組織的危害に転化させる3つの要因としてアクセス・権限・信頼を特定し、7つの行動保証原則を定めている。詳細な運用レポートが近日公開予定とされた。
なぜ重要か
これは英国国立研究所プロジェクトにおける最初の出版物であり、機密性・高リスク組織(政府、重要セクター)に対し、モデル評価を超えたエージェント行動保証のための語彙を提供するもので、「エージェントは行動するが開発者は遅れて検知する」というインシデントパターンを補完し、英国の保証・ガバナンスフレームワークに情報を提供する。
必要な対応
英国の高リスク・規制環境におけるCISOおよびAIガバナンスチームは、エージェンティックAIの監視・介入制御の範囲を定める際に、障害モード分類法とアクセス・権限・信頼のレンズを使用すべきである。