Pedoman  ·  2026-09-28

Behavioural Assurance of Agentic AI untuk Organisasi Sensitif dan Berisiko Tinggi (makalah penelitian CETaS)

PedomanMedium dampakGlobal
Sekitar 23 September 2026, CETaS (Centre for Emerging Technology and Security, bagian dari Alan Turing Institute Inggris) menerbitkan makalah oleh Prof. Rick Hennessy dan Dr. Carolyn Ashurst yang mengusulkan kerangka sosioteknis untuk jaminan perilaku AI agentik. Makalah ini memperkenalkan taksonomi mode kegagalan perilaku yang mencakup agen individu, sistem multi-agen, dan interaksi manusia-agen, mengidentifikasi akses/otoritas/kepercayaan sebagai tiga faktor yang mengubah perilaku agen menjadi kerugian organisasi, dan menetapkan tujuh prinsip jaminan perilaku. Laporan operasional terperinci ditandai akan segera terbit.
Ini adalah publikasi pertama dalam proyek institut nasional Inggris yang memberi organisasi sensitif/berisiko tinggi (pemerintah, sektor kritis) kosakata untuk menjamin perilaku agen melampaui evaluasi model — melengkapi pola insiden 'agen bertindak tetapi pengembang mendeteksi terlambat' dan memberi masukan ke kerangka jaminan dan tata kelola Inggris.
CISO dan tim tata kelola AI di lingkungan Inggris/teregulasi berisiko tinggi harus menggunakan taksonomi mode kegagalan dan lensa akses/otoritas/kepercayaan saat menentukan ruang lingkup pengawasan AI agentik dan kontrol intervensi.
CETaS publication pageThe Alan Turing Institute blog — How can obedient agents behave badly?
Lihat di umpan langsung Jelajahi temuan keamanan dan tata kelola AI terkait — diperbarui setiap pagi.
Buka umpan →