Seorang penyerang menyembunyikan instruksi berbahaya dalam konten yang dibaca oleh agen AI (injeksi prompt tidak langsung) dan kemudian memasukkannya ke dalam log agen (pemalsuan log), sehingga instruksi jahat tersebut terserap ke dalam memori jangka panjang yang diandalkan agen (peracunan memori AI pada memori agentik persisten). Setelah teracuni, memori tersebut diam-diam merusak keputusan agen lama setelah konten aslinya hilang.
Topik glosarium
Agent memory poisoning attack chain
Istilah dalam topik ini
Pantau di umpan langsung
Lihat bagaimana hal ini terwujud dalam perkembangan keamanan dan tata kelola AI nyata.
Buka umpan →