战略报告  ·  2026-09-20

开放权重AI模型可能增加生物滥用风险:评估反拒绝篡改、能力增强和公开可用的无审查模型

战略报告High 影响Global
RAND的AI、安全和技术中心测试了前沿开放权重LLM是否可被修改用于恶意生物目的,检查了反拒绝篡改、能力增强和公开可用的无审查模型变体。头条发现:移除LLM的安全训练是"高度可行的",而增强LLM超越基线的生物能力则更困难。定制的生物安全评估表明,仅通过安全移除——无需能力提升——仍可能帮助现实的生物武器威胁路径。
直接影响开放权重vs.闭源权重AI发布政策辩论和出口管制讨论;安全和政策领导者需要这个证据基础来做出关于模型发布保障的决策。
向国家安全和信任与安全团队简报任何开放权重模型发布或部署的反篡改保障措施。
RAND Corporation — Open-Weight AI Models May Increase Biological Misuse Risks
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →