무슨 일이 있었나
2026년 8월 7일, OpenAI는 아직 공개되지 않은 Astra 모델의 예비 평가 결과 사이버 능력이 Preparedness Framework의 중대 임계값을 넘을 가능성을 '배제할 수 없다'는 것을 공개했으며, 이는 OpenAI 모델 중 처음이다. OpenAI는 일부 내부 Astra 작업을 중단했고, 개발을 네트워크 접근이 제한된 격리/샌드박스 환경으로 이전했으며, 정부 기관과 외부 안전 조직을 테스트에 투입했다.
왜 중요한가
프론티어 랩이 모델을 최고 수준의 자율 사이버 공격 능력 계층에 도달할 가능성이 있는 것으로 공개적으로 지적한 것은 이번이 처음이며, 개발 단계 보안조치(네트워크 격리, 사고의 연쇄 모니터링, 제3자 검토)를 직접 발동시킨다. 이는 AI 안전 거버넌스의 획기적인 시험이며 공개 전 프론티어 사이버 능력 모델이 어떻게 제한되는지에 대한 즉각적인 영향을 미친다.
적용 범위
프론티어 모델 위험 임계값을 추적하는 CISO, AI 안전/거버넌스 팀, 규제 담당자는 OpenAI의 Preparedness Framework 발동 조건을 지금 검토하고 Astra의 단계적 공개 시 선례 설정 억제 관행을 모니터링해야 한다.