解决方案  ·  2026-08-09

OpenAI 披露 Astra 模型可能跨越"关键"网络安全能力阈值,触发准备框架防护措施

解决方案High 影响Global
2026 年 8 月 7 日,OpenAI 披露其未发布的 Astra 模型的初步评估显示网络能力强大到"无法排除"该模型跨越其准备框架中关键阈值的可能性——这是 OpenAI 任何模型的首次。OpenAI 已暂停一些内部 Astra 工作,将开发转移到具有受限网络访问的隔离/沙箱环境中,并邀请政府机构和外部安全组织进行测试。
这是前沿实验室首次公开标记模型可能达到最高自主网络攻击能力级别,直接触发具有约束力的开发阶段防护措施(网络隔离、思维链监控、第三方审查)——这是一次人工智能安全治理的标志性测试,对如何在发布前控制前沿网络能力模型具有直接影响。
追踪前沿模型风险阈值的首席信息安全官、人工智能安全/治理团队和监管机构应立即审查 OpenAI 的准备框架触发器,并监控 Astra 的分阶段发布以获取具有先例意义的遏制实践。
OpenAIUnite.AITechCrunch — OpenAI says it slowed Astra model development over security concernsThe Guardian — OpenAI to pause some work on AI model Astra due to security concerns
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →