Apa yang terjadi
RAND memperluas kerangka kerja keamanan 'Securing AI Model Weights' ke kelas aset baru: wawasan algoritmik — teknik, metode, dan pengetahuan desain (berbeda dari bobot model) yang secara material meningkatkan sistem AI dan dapat berada dalam kode, dokumen, komunikasi, atau bahkan memori peneliti. Laporan 99 halaman ini mengidentifikasi 44 vektor serangan di sembilan kategori dan mengusulkan lima Insight Security Levels (ISLs) kumulatif yang disesuaikan dengan lima tingkat kemampuan lawan, dengan kompartementalisasi sebagai prinsip pengorganisasian pusat. Para penulis menemukan bahwa 'pengungkapan tanpa izin dapat mengikis keunggulan teknologi dan, dalam beberapa kasus, menurunkan hambatan terhadap kemampuan AI yang berbahaya,' dan bahwa perlindungan ISL4/ISL5 teratas terhadap lawan tingkat negara dapat memerlukan fasilitas terisolasi, pemeriksan personel intensif, dan pembatasan pekerjaan jarak jauh dan perjalanan — langkah-langkah yang 'mungkin memerlukan dukungan pemerintah dan persiapan selama bertahun-tahun.'
Mengapa penting
Bagi lab, penyedia cloud, dan pembuat kebijakan keamanan nasional, ini adalah roadmap sistematis pertama untuk melindungi 'soft IP' pengembangan AI frontier — permukaan ancaman yang tidak dicakup oleh kerangka kerja keamanan siber dan kontrol ekspor konvensional — secara langsung menginformasikan program risiko insider dan keputusan investasi kompartementalisasi.
Tindakan yang diperlukan
CISO dan kepala keamanan penelitian AI harus memetakan praktik perlindungan wawasan saat ini terhadap lima tingkat ISL dan menilai wawasan internal mana yang memerlukan kontrol kompartementalisasi ISL3+.