何が起きたか
UK AI Security Institute (AISI) と US Center for AI Standards and Innovation (CAISI) は、Moonshot AI の Kimi K3 モデル (2026年7月16日リリース、2026年7月27日にオープンウェイト公開) を共同で評価し、「予備的なサイバー評価において米国の主要フロンティアモデルを下回るパフォーマンス」であることを発見しました。ExploitBench ベンチマークでは、Kimi K3 は32% のスコア (以前の最もサイバー能力の高いオープンウェイトモデルである GLM-5.2 の24% と比較) を達成しましたが、41サンプル中0件で任意コード実行 (最高度の深刻度を持つエクスプロイト結果) を達成しました。32ステップのシミュレーション企業ネットワーク攻撃 ('The Last Ones') では、平均してステップ17に到達しました。重要なことに、評価者は Kimi K3 のセーフガード 「評価中にサイバーエクスプロイト開発または攻撃的なサイバー作業を試みることを防止しなかった」ことを発見しました — これは初めて公開されたセーフガード障害の知見です。方法論は、公開および非公開ベンチマーク全体における Item Response Theory に着想を得た集約アプローチを使用し、結果は予備的なものとして明示的にフラグが立てられ、真のオープンウェイト能力を過小評価する可能性があります。
なぜ重要か
これは米国と中国のフロンティア AI サイバー能力ギャップを定量化する初の種類の UK-US 政府技術評価であり、リリースされた中国モデルの安全ガードレールが テスト中に攻撃的なサイバー作業の試みをブロックできなかったことを公開しています — これは CISO がデュアルユース モデルリスクを評価し、政策立案者が輸出管理とオープンウェイト政策を検討する際に直接関連しています。
必要な対応
セキュリティリーダーシップに対し、オープンウェイト サイバー能力ギャップについてブリーフィングし、AI インザループの脅威モデルを、攻撃的なサイバータスクを試みる寛容なセーフガード を備えたモデルを考慮するように更新してください。