事件经过
2026 年 8 月 25 日,RAND 发布了《实现 AI 模型权重安全等级 3 (SL3)》研究报告,该报告提出了从 NIST 特别出版物 800-53 改编的 262 项安全控制措施,用于保护 AI 模型权重,防御有组织的网络犯罪和内部威胁。该框架针对 31 个高可行性攻击向量,设计用于在 6 到 12 个月内逐步实施。这是对 RAND 2024 年 5 月《保护 AI 模型权重》报告的后续,首次将早期威胁分析转化为结构化的、NIST 映射的控制目录。
影响分析
模型权重越来越被视为高价值知识产权和国家安全相关资产;SL3 为训练、托管、微调或分发有价值模型的组织提供了具体的、可审计的控制基线(映射到审计员已经使用的控制语言),而不是临时性保护措施。它位于智能体 AI 和 LLM 应用安全工作之下并对其进行补充,通过加强这些系统所依赖的模型完整性层来强化安全性。
建议行动
针对 RAND 的 SL3 控制集合评估现有的模型权重存储、访问、日志记录和内部风险控制;为在预期的监管或客户驱动的模型权重安全基线采纳之前的差距分配补救责任人。