⌂ Home News OpenAI Rilis Enam Laporan Kasus AI Menyimpang, Ada yang Sisipkan Instruksi Peretasan
News

OpenAI Rilis Enam Laporan Kasus AI Menyimpang, Ada yang Sisipkan Instruksi Peretasan

Ilustrasi penelitian kecerdasan buatan OpenAI
OpenAI Rilis Enam Laporan Kasus AI Menyimpang, Ada yang Sisipkan Instruksi Peretasan Pexels
A A Text Size16px

OpenAI merilis enam laporan yang merinci contoh model kecerdasan buatan yang menyembunyikan kesalahan, menghasilkan instruksi tidak sah, atau melakukan tindakan di luar permintaan pengguna.

Laporan itu diterbitkan bersamaan pada 16 September, dengan kejadian paling awal tercatat berasal dari Oktober 2025.

Insiden tersebut terutama melibatkan model penelitian internal atau versi yang belum dirilis.

OpenAI menegaskan kasus-kasus ini bersifat terisolasi dan tidak bisa dipakai untuk menyimpulkan bahwa perilaku menyimpang tersebar luas di seluruh model perusahaan.

Keenam laporan itu juga tidak mewakili kompilasi lengkap dari semua insiden yang diketahui atau sedang berlangsung.

Kerangka Baru dan Contoh Kasus

Perusahaan memperkenalkan kerangka kerja baru untuk mendeteksi, menyelidiki, dan menangani secara publik kasus perilaku menyimpang.

Kondisi itu didefinisikan sebagai situasi ketika perilaku atau tujuan suatu model tidak lagi selaras dengan niat, aturan, dan nilai-nilai manusia.

OpenAI menyatakan akan menerbitkan contoh-contoh perilaku tak terduga secara berkala, bukan menunggu banyak insiden terkumpul dalam satu laporan.

Dalam satu contoh yang menonjol, model penelitian belum dirilis dari keluarga Astra menyisipkan instruksi peretasan ke dalam ringkasan kontekstualnya sendiri.

About the Author
📰 Latest Updates