解决方案  ·  2026-08-10

OpenAI将即将推出的Astra模型分类为首个"关键"网络安全能力模型,增加监控控制

解决方案High 影响Global
OpenAI披露(2026年8月7日)其对即将推出的Astra模型进行的内部评估显示,其代理编码/网络安全性能足以触发其应急框架中最高的"关键"网络安全能力等级,并宣布在所有代理Astra应用中进行通用思维链监控,以及对高风险活动的自动中断。
这是前沿实验室首次在公共安全框架下将模型分类为接近关键等级的攻击性网络能力,直接改变了企业和监管机构对前沿模型访问控制和监控要求的思考方式。
评估前沿模型访问策略的首席信息安全官、AI治理团队和监管机构应在任何Astra部署或评估访问之前审查OpenAI的新安全措施。
OpenAIInteresting Engineering
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →