Semua serangan ini memanfaatkan kelemahan dalam batas teknis yang dirancang untuk membatasi agen pengodean AI, memungkinkan penyerang untuk keluar dari sandbox melalui injeksi template, lingkungan evaluasi, atau permintaan web yang dipalsukan. Masing-masing bergantung pada penipuan agen untuk menjalankan kode atau tindakan tidak sah di luar batas kepercayaan yang dimaksudkan, pada akhirnya memungkinkan eksekusi kode jarak jauh atau penyalahgunaan gaya confused-deputy.
Topik glosarium
AI Agent Sandbox and Injection Exploits
Istilah dalam topik ini
Pantau di umpan langsung
Lihat bagaimana hal ini terwujud dalam perkembangan keamanan dan tata kelola AI nyata.
Buka umpan →