Apa yang terjadi
Nirlaba keamanan AI FAR.AI meluncurkan (29 Juli 2026) leaderboard.far.ai, tolok ukur publik independen yang menguji safeguard model frontier terhadap 60+ teknik jailbreak di domain CBRNE dan cyber, menemukan celah robustness >100x antar model (Grok 4.5/Gemini 3.1 Pro rusak untuk <$300; Claude Fable 5/GPT-5.6 Sol bertahan di atas $14,200), bersama dengan baseline 'Minimal Standard for Safeguards v1.0' yang baru.
Mengapa penting
Menyediakan metrik pertama yang terstandarisasi, lintas vendor, berbasis biaya untuk robustness jailbreak AI, memberikan enterprise dan regulator cara independen untuk membandingkan klaim keamanan model frontier daripada mengandalkan self-reporting vendor.
Cakupan penerapan
CISO dan tim AI-governance yang memilih/menyaring model frontier untuk deployment berisiko tinggi; pembuat kebijakan yang merancang baseline keamanan AI.