무슨 일이 있었나
AI 안전 비영리단체 FAR.AI가 (2026년 7월 29일) leaderboard.far.ai를 출시했으며, 이는 CBRNE 및 사이버 영역에서 60개 이상의 탈옥 기법에 대한 프론티어 모델 보안을 테스트하는 독립적인 공개 벤치마크로, 모델 간 >100배의 견고성 격차를 발견했습니다 (Grok 4.5/Gemini 3.1 Pro는 <$300 미만에서 손상; Claude Fable 5/GPT-5.6 Sol은 $14,200 이상 유지), 새로운 'Minimal Standard for Safeguards v1.0' 기준과 함께 제시됩니다.
왜 중요한가
AI 탈옥 견고성을 위한 최초의 표준화되고 벤더 간 비교 가능하며 비용 기반의 메트릭을 제공하여, 기업과 규제 당국이 벤더 자체 보고에 의존하지 않고 독립적으로 프론티어 모델 안전 주장을 비교할 수 있는 방법을 제공합니다.
적용 범위
고위험 배포를 위해 프론티어 모델을 선택/검증하는 CISO 및 AI 거버넌스 팀; AI 안전 기준선을 초안하는 정책 입안자.