무슨 일이 있었나
OpenAI는 (2026년 8월 7일) 향후 Astra 모델에 대한 내부 평가 결과 에이전트 코딩/사이버보안 성능이 Preparedness Framework의 최고 '중대' 사이버보안 기능 등급을 트리거할 만큼 강력하다는 것을 공개했으며, 모든 에이전트 Astra 애플리케이션에 걸친 보편적인 Chain-of-Thought 모니터링과 고위험 활동의 자동 중단을 발표했다.
왜 중요한가
이는 최초로 frontier 연구 기관이 공개 안전 프레임워크 하에서 모델을 중대 수준의 공격용 사이버 기능에 접근하는 것으로 분류한 것이며, 엔터프라이즈와 규제기관이 frontier 모델 접근 제어 및 모니터링 요구사항에 대해 어떻게 생각해야 하는지를 직접적으로 재형성한다.
적용 범위
Astra 배포 또는 평가 액세스를 고려하는 CISO, AI 거버넌스 팀 및 규제기관은 OpenAI의 새로운 안전장치를 검토해야 한다.