Apa yang terjadi
Pusat RAND untuk AI, Keamanan, dan Teknologi menguji apakah LLM perbatasan bobot terbuka dapat dimodifikasi untuk tujuan biologis berbahaya, memeriksa penghapusan anti-penolakan, peningkatan kemampuan, dan varian model yang tidak tersensor yang tersedia secara publik. Temuan judul: menghilangkan pelatihan keamanan LLM adalah 'sangat layak', sementara meningkatkan kemampuan biologis LLM di luar garis dasar lebih sulit. Evaluasi keamanan biosistem khusus menunjukkan bahwa penghapusan keamanan saja — tanpa peningkatan kemampuan — masih dapat membantu jalur ancaman senjata biologis yang realistis.
Mengapa penting
Secara langsung menginformasikan perdebatan kebijakan rilis AI bobot terbuka vs. bobot tertutup dan diskusi kontrol ekspor; pemimpin keamanan dan kebijakan memerlukan basis bukti ini untuk keputusan tentang penjaga rilis model.
Tindakan yang diperlukan
Informasikan tim keamanan nasional dan kepercayaan & keselamatan tentang penjaga anti-kerusakan untuk rilis atau penerapan model bobot terbuka apa pun.