Definisi
Suatu cara pengujian model AI untuk keamanan atau kemampuan di mana baik penguji maupun perusahaan AI tidak dapat melihat detail rahasia satu sama lain, menggunakan lingkungan komputasi khusus yang terkunci (sebuah 'secure enclave') untuk menjalankan pengujian secara blind di kedua belah pihak. Hal ini mencegah perusahaan menyesuaikan model mereka dengan pengujian yang diketahui, dan melindungi pertanyaan evaluasi proprietary penguji.
Mengapa penting
Seiring pemerintah bergerak menuju audit pihak ketiga wajib dari model AI yang kuat, metode blind-testing yang dapat dipercaya adalah apa yang menghentikan audit tersebut dari dimanipulasi atau bocor.