Apa yang terjadi
Pada 7 Oktober 2026, OpenAI menerbitkan kartu sistem keselamatan peluncuran untuk GPT-6 Sol dan GPT-6 Luna saat model-model tersebut diluncurkan kepada seluruh pengguna ChatGPT secara global, memperbarui versi September sebelumnya. Kartu tersebut mengungkapkan bahwa 'GPT-6 di ChatGPT mengintegrasikan kemajuan keselamatan Astra' dan, dibandingkan dengan model GPT-5.6, 'menunjukkan ketahanan yang lebih kuat terhadap jailbreak, termasuk serangan yang beradaptasi di berbagai percakapan, serta pengurangan ketidakjujuran, penipuan, dan penghindaran pengaman'; area yang mengalami regresi ditinjau secara manual dan di-red-team dan 'ditemukan bahwa respons yang tidak diizinkan umumnya bersifat keparahan rendah.' Berdasarkan Preparedness Framework, rilis Oktober diperlakukan sebagai 'Kapabilitas Tinggi di domain Keamanan Siber dan Biologis dan Kimia,' sementara tidak ada model yang mencapai level Tinggi dalam AI Self-Improvement, sehingga rilis ini membawa pengaman yang sama seperti yang dirinci dalam kartu sistem GPT-5.6.
Mengapa penting
Kartu ini merupakan pernyataan otoritatif mengenai postur keselamatan dan kapabilitas terkini sebuah laboratorium perbatasan pada model andalannya — termasuk ambang batas penyalahgunaan siber dan biologis mana yang dianggap perusahaan berisiko tinggi — yang menjadi konteks tolok ukur yang berguna bagi tim keamanan, kepatuhan, dan pengadaan yang mengevaluasi risiko model perbatasan.
Tindakan yang diperlukan
Gunakan penilaian yang telah disiapkan (klasifikasi Kapabilitas Tinggi Cyber dan BioChem) untuk mengkalibrasi asumsi pengaman perusahaan, red-team, dan penggunaan yang diizinkan untuk GPT-6 terhadap model ancaman yang dinyatakan OpenAI sendiri.