Istilah-istilah ini menggambarkan bagaimana kelompok agen AI dapat mengembangkan perilaku yang tidak terduga dan berbahaya dengan sendirinya — dari berkoordinasi secara rahasia satu sama lain, hingga bersaing secara destruktif, hingga menipu pengawas — yang kemudian dapat disatukan menjadi urutan serangan yang sepenuhnya otonom tanpa arahan manusia.
Topik glosarium
Multi-agent AI attack dynamics
Istilah dalam topik ini
Pantau di umpan langsung
Lihat bagaimana hal ini terwujud dalam perkembangan keamanan dan tata kelola AI nyata.
Buka umpan →