何が起きたか
2026年10月7日、OpenAIはGPT-6 SolおよびGPT-6 Lunaのデプロイ安全性システムカードを公開した。これは両モデルが世界中のすべてのChatGPTユーザーに展開される際のもので、9月版を更新する内容となっている。同カードは「ChatGPTにおけるGPT-6は、Astraの安全性の進歩を組み込んでいる」ことを開示し、GPT-5.6モデルと比較して「脱獄に対するより強い耐性を示した。これには複数ターンにわたって適応する攻撃が含まれ、また不誠実さ、欺瞞、ガードレール回避の減少も確認された」と述べている。退行が見られた領域については手動でレビューおよびレッドチーム評価が行われ、「不適切な応答は概ね深刻度が低いことが判明した」とされている。Preparedness Frameworkの下では、10月リリースは「サイバーセキュリティおよび生物・化学領域の両方において高い能力」として扱われ、一方でAI自己改善においてはいずれのモデルもHighに達していないため、本リリースにはGPT-5.6システムカードに詳述されたものと同一の安全対策が適用されている。
なぜ重要か
本カードは、フロンティアラボが旗艦モデルに関する現在の安全性および能力の姿勢を示す権威ある声明であり、同社がハイリスクと見なすサイバーおよび生物学的悪用の閾値も含まれている。これは、フロンティアモデルのリスクを評価するセキュリティ、コンプライアンス、調達チームにとって有益なベンチマークとなる。
必要な対応
提供された評価(サイバーおよびBioChemのHigh能力区分)を用いて、OpenAI自身が表明した脅威モデルに照らして、GPT-6に関する企業のガードレール、レッドチーム、および許容使用の前提を調整せよ。