Apa yang terjadi
OpenAI menerbitkan pengungkapan pertama berbasis data tentang kemajuan internal menuju Recursive Self-Improvement (RSI), melaporkan bahwa telah mencapai tujuan yang sebelumnya diumumkan untuk membangun 'magang penelitian otomatis' — sistem yang dapat melaksanakan tugas penelitian yang terdefinisi dengan baik yang akan memakan waktu beberapa hari bagi peneliti manusia terampil — pada September 2026, dan menargetkan peneliti AI yang sepenuhnya otomatis pada Maret 2028. Laporan tersebut mengukur pergeseran: peneliti OpenAI median beralih dari penggunaan coding-agent yang sederhana di awal tahun ke integrasi harian pada pertengahan Agustus, menggunakan lebih dari $600/hari inference pada harga API (peneliti persentil ke-90 menggunakan lebih dari $7.000/hari), dengan total runtime agent sekarang melebihi total jam kerja manusia dalam organisasi penelitian sejak Juni 2026. Laporan tersebut mencakup lampiran metodologi dan menyatakan OpenAI 'belum mengetahui cara yang aman untuk mencapai sepenuhnya aligned, full RSI,' mengutip insiden OpenAI/Hugging Face baru-baru ini sebagai alasan untuk menghentikan dan menguatkan pelatihan RL. OpenAI menyerukan bahwa perusahaan ini dan yang lain secara hukum diwajibkan untuk secara terbuka melacak kemajuan RSI, sesuai dengan Frontier Policy Blueprint-nya.
Mengapa penting
Ini adalah pengungkapan pertama yang dikuantifikasi, dari sumber primer, tentang seberapa dekat lab frontier terhadap R&D AI yang mempercepat diri sendiri — titik infleksi kemampuan dengan implikasi langsung untuk tata kelola AI, dinamika kompetitif, dan kecepatan pekerjaan keselamatan versus kemampuan; dewan dan pembuat kebijakan membutuhkan ini sebagai dasar untuk persyaratan pengawasan dan pengungkapan terkait RSI.
Tindakan yang diperlukan
Beritahu dewan dan komite risiko tentang pengungkapan trajektori RSI dan evaluasi apakah kerangka tata kelola (misalnya, piagam pengawasan AI dewan) perlu memiliki pemicu pacing RSI eksplisit yang mirip dengan komitmen jeda keselamatan yang dinyatakan OpenAI.