事件经过
2026 年 8 月 7 日,OpenAI 披露其未发布的 Astra 模型的初步评估显示网络能力强大到"无法排除"该模型跨越其准备框架中关键阈值的可能性——这是 OpenAI 任何模型的首次。OpenAI 已暂停一些内部 Astra 工作,将开发转移到具有受限网络访问的隔离/沙箱环境中,并邀请政府机构和外部安全组织进行测试。
影响分析
这是前沿实验室首次公开标记模型可能达到最高自主网络攻击能力级别,直接触发具有约束力的开发阶段防护措施(网络隔离、思维链监控、第三方审查)——这是一次人工智能安全治理的标志性测试,对如何在发布前控制前沿网络能力模型具有直接影响。
适用范围
追踪前沿模型风险阈值的首席信息安全官、人工智能安全/治理团队和监管机构应立即审查 OpenAI 的准备框架触发器,并监控 Astra 的分阶段发布以获取具有先例意义的遏制实践。