Attack  ·  Glosarium

Adversarial reasoning extraction

Teknik yang digunakan untuk memaksa model AI mengungkap 'pemikiran' langkah-demi-langkah yang tersembunyi — jejak penalaran — yang dirancang untuk dirahasiakan, sehingga kemampuannya dapat disalin, dikloning, atau direkayasa balik. Kampanye terkoordinasi dan berskala besar untuk mengekstrak penalaran ini dapat setara dengan pencurian skala industri atas kemampuan terlindungi sebuah model.
Bagi pengembang AI, jejak penalaran adalah salah satu rahasia dagang paling berharga mereka; bagi perusahaan, memahami ancaman ini membantu menentukan penyedia model mana yang dapat secara kredibel melindungi penalaran proprietary.
Pantau di umpan langsung Lihat bagaimana hal ini terwujud dalam perkembangan keamanan dan tata kelola AI nyata.
Buka umpan →