Apa yang terjadi
Frontier Red Team dari Anthropic menerbitkan evaluasi terhadap GLM-5.3, model frontier berbobot terbuka milik Zhipu AI (Z.ai), yang menemukan bahwa penyerang dapat melewati pengamanannya antara 64% hingga 100% dari waktu menggunakan teknik sederhana dalam uji simulasi. GLM-5.3 mengembangkan eksploit end-to-end pada tingkat yang sebanding dengan Claude Mythos Preview (50 dari 410 percobaan pada ExploitBench vs. 56), setara dengan model pertama yang mampu membangun eksploit end-to-end secara otonom — namun, tidak seperti rilis yang diamankan Anthropic, model ini dapat diunduh secara bebas. Dalam sesi pakar manusia, model ini mengidentifikasi kerentanan yang sebelumnya tidak diketahui dan merangkainya menjadi eksploit yang berfungsi yang dapat membaca file arbitrer dari komputer korban, dan model ini berhasil melakukan pembajakan alur kontrol penuh dalam 4% percobaan Binary Exploitation di mana model terbuka sebelumnya tidak menyelesaikan satu pun. Mengutip NIST CAISI, laporan tersebut mencatat bahwa GLM-5.3 adalah 'model berbobot terbuka dengan kemampuan siber paling canggih yang dirilis hingga saat ini' dan menilai bahwa pengamanannya yang longgar 'secara signifikan meningkatkan kemampuan siber yang tersedia bagi aktor jahat.'
Mengapa penting
Bagi para CISO dan pemimpin keamanan, ini adalah pernyataan konkret dan terukur bahwa kemampuan setara rekayasa eksploit kini beredar dalam model berbobot terbuka yang dapat diunduh siapa saja — sebuah pergeseran material dalam garis dasar ancaman eksternal yang harus menjadi bahan pertimbangan dalam investasi pertahanan dan tinjauan paparan perangkat lunak kritis.
Tindakan yang diperlukan
Tinjau apakah personel, rantai pasokan, atau aset yang menghadap internet dapat terpapar rantai eksploit yang didukung GLM-5.3 dan percepat mitigasi kerentanan browser, driver, dan perangkat jaringan yang belum ditambal.