Apa yang terjadi
Pada 7 Agustus 2026, OpenAI mengungkapkan bahwa evaluasi awal dari model Astra yang belum dirilis menunjukkan kemampuan siber yang cukup kuat sehingga 'tidak dapat dikecualikan' model melampaui ambang batas Kritis dalam Preparedness Framework-nya — yang pertama kali untuk model OpenAI mana pun. OpenAI telah menghentikan beberapa pekerjaan Astra internal, memindahkan pengembangan ke lingkungan terisolasi/sandbox dengan akses jaringan terbatas, dan menghadirkan lembaga pemerintah serta organisasi keselamatan eksternal untuk pengujian.
Mengapa penting
Ini adalah pertama kalinya lab frontier secara publik menandai model sebagai berpotensi mencapai tingkat kemampuan cyber-offense otonom tertinggi, secara langsung memicu pengamanan tahap pengembangan yang mengikat (isolasi jaringan, pemantauan chain-of-thought, tinjauan pihak ketiga) — ujian landmark dari tata kelola keselamatan AI dengan implikasi segera untuk bagaimana model cyber-capable frontier gated sebelum rilis.
Cakupan penerapan
CISO, tim keselamatan AI/tata kelola, dan regulator yang melacak ambang batas risiko model frontier harus meninjau pemicu Preparedness Framework OpenAI sekarang dan memantau rilis bertahap Astra untuk praktik penahanan yang menetapkan preseden.