何が起きたか
OpenAIは(2026年8月7日)、近日発表予定のAstraモデルの内部評価により、エージェント型コーディング/サイバーセキュリティのパフォーマンスが同社のPreparedness FrameworkにおけるCritical(最高レベル)サイバーセキュリティ能力階級をトリガーするほど強力であることが判明したことを開示しました。また、すべてのエージェント型Astraアプリケーション全体での統一Chain-of-Thought監視と、高リスク活動の自動中断を発表しました。
なぜ重要か
これは、フロンティアラボが公開安全性フレームワーク下でCritical階級の攻撃的サイバー能力に近づくモデルとして分類した初のケースであり、企業と規制当局がフロンティアモデルのアクセス制御および監視要件についてどのように考える必要があるかを直接的に再形成しています。
適用範囲
フロンティアモデルのアクセスポリシーを評価しているCISO、AIガバナンスチーム、および規制当局は、Astra展開または評価アクセスの前に、OpenAIの新しいセーフガードを確認する必要があります。