戦略レポート  ·  2026-09-20

オープンウェイトAIモデルは生物学的悪用リスクを増加させる可能性:抗拒否改ざん、機能強化、および公開されている無修正モデルの評価

戦略レポートHigh 影響度Global
RANDのAI、セキュリティ、および技術センターは、最先端のオープンウェイトLLMが悪意のある生物学的目的で改変可能かどうかをテストし、抗拒否改ざん、機能強化、および公開されている無修正モデルバリエーションを検査しました。主要な調査結果:LLMの安全性トレーニングを削除することは「非常に実行可能」であり、LLMの生物学的機能をベースラインを超えて強化することはより困難です。カスタム生物防御評価は、機能向上なしで安全性削除だけでも、現実的なバイオウェポンズの脅威経路を支援できることを示唆しています。
オープンウェイトと閉じたウェイトのAIリリースポリシーの議論と輸出管理の議論に直接情報を提供します。セキュリティおよびポリシーリーダーは、モデルリリースセーフガードに関する決定のためにこの証拠ベースが必要です。
オープンウェイトモデルのリリースまたはデプロイメントについて、抗改ざんセーフガードに関する国家安全保障および信頼とセーフティチームをブリーフしてください。
RAND Corporation — Open-Weight AI Models May Increase Biological Misuse Risks
ライブフィードで見る AIセキュリティとガバナンスの関連情報をさらに見る — 毎朝更新。
フィードを開く →