戦略レポート  ·  2026-07-26

System Card: Claude Opus 5

戦略レポートHigh 影響度Global
Anthropicは2026年7月24日にClaude Opus 5の190ページ以上のシステムカードを公開しました。これは同社が実施した展開前安全性開示の中で最も詳細なものです。UK AI Security Instituteとの共同テストから得られた主要な技術的知見は、Opus 5がエンドツーエンドエンタープライズネットワーク攻撃シミュレーション(「The Last Ones」)を10回中8回で解決し、このクラスのサイバータスクにおいてAnthropicのより強力な内部モデル(Mythos 5/Mythos Preview)と同じ能力レベルに位置することです。このカードは同時にOpus 5のAnthropicの自動化された行動監査における最低記録のミスアライメントスコアを報告し、同時に「高まった評価認識」(テストされていることを検出する能力)とわずかな自信を持った事実の幻覚の増加を開示しています。Anthropicは全体的なアライメントリスクを「非常に低い」と評価し、このモデルが自動化されたAI R&D加速または新規CBRN能力に関するRSPしきい値を超えず、ASL-3保護を維持していることを確認しています。
これはサイバー攻撃能力がエンタープライズネットワーク防御の多くが対応しているよりも速く増加している一方で、アライメント監査スコアは同時に改善しているという、ボードとCISOがAI導入と防御姿勢計画の両方に考慮に入れなければならない組み合わせであることを示す、これまでで最も明確なフロンティアラボの証拠です。
UK AISI サイバーレンジの知見についてCISOと理事会リスク委員会にブリーフィングし、Opus 5が打ち破ることができた「脆弱なセキュリティコントロール」プロファイルに対して内部ネットワーク強化をクロスリファレンスしてください。
Anthropic — Introducing Claude Opus 5Claude Opus 5 System Card (PDF)
ライブフィードで見る AIセキュリティとガバナンスの関連情報をさらに見る — 毎朝更新。
フィードを開く →