정의
검증된 보안 전문가가 프론티어 AI 모델을 사용하여 실제 취약점을 찾고 검증하는 특정 목적을 위해 안전장치를 완화된 상태로 실행할 수 있도록 하는 통제된 프로그램입니다. 접근은 등급별로 승인되며, 모델의 안전장치는 승인된 방어 작업에 대해서만 완화되고 일반 사용에는 적용되지 않습니다. 이는 사이버 역량을 갖춘 모델을 활용할 수 있는 대상을 확대하면서도 그러한 힘이 핵심 인프라에 광범위하게 방출되는 것을 방지합니다.
왜 중요한가
방어자에게는 결함이 실제임을 증명할 수 있는 모델이 필요합니다. 적절히 게이트된 접근은 보안 팀에게 그러한 역량을 제공하면서 강력한 모델이 오용될 위험을 관리합니다.