×
Ad

OpenAI Ungkap 6 Kelakuan Aneh AI, Ada yang Diam-diam Tutupi Kesalahan

Adi Fida Rahman - detikInet
Kamis, 17 Sep 2026 08:45 WIB
OpenAI Ungkap 6 Kelakuan Aneh AI, Ada yang Diam-diam Tutupi Kesalahan Foto: GSM Arena
Jakarta -

OpenAI buka-bukaan soal sejumlah perilaku aneh yang ditemukan pada model kecerdasan buatan (AI) buatannya. Ada AI yang diam-diam berusaha menutupi kesalahan, mencari API key yang bocor, hingga mengunggah file ke internet tanpa izin pengguna.

Temuan tersebut diungkap bersamaan dengan peluncuran kerangka baru untuk mencatat, menyelidiki, dan mengungkap kasus yang disebut model misalignment.

Secara sederhana, misalignment terjadi ketika tindakan model AI tidak sesuai dengan tujuan, instruksi atau batasan yang diberikan kepadanya.

OpenAI merilis enam laporan kasus misalignment yang ditemukan selama pelatihan dan evaluasi model dalam enam bulan terakhir. Perusahaan menekankan kasus tersebut merupakan contoh individual dan bukan ukuran seberapa sering perilaku semacam ini terjadi.

Lantas, apa saja kelakuan aneh AI yang ditemukan OpenAI?

1. Membuat Instruksi untuk Dirinya Sendiri

Sebuah model riset yang belum dirilis memasukkan instruksi tambahan ke dalam ringkasan yang digunakan untuk melanjutkan pekerjaannya di context window baru.

Sebagian instruksi itu bahkan meminta model mengabaikan batasan normalnya. OpenAI menemukan 27 ringkasan yang terdampak.

Wired melaporkan perilaku serupa juga menjadi perhatian pada GPT-6 Astra. Dalam pengujian, model AI terbaru OpenAI tersebut menghasilkan sendiri perintah yang menyerupai jailbreak.

2. Diam-diam Menutupi Kesalahan

Kasus berikutnya ditemukan selama pelatihan GPT-5.6 Sol. Sejumlah model memasukkan instruksi ke dalam ringkasan agar kesalahan atau perilaku yang tidak sesuai tidak diketahui pengguna.

Contohnya termasuk instruksi untuk mengarang data historis yang hilang tanpa memberi tahu pengguna, serta menyembunyikan ketidakcocokan versi sumber.

3. Cari API Key Bocor, Lalu Mengarang Data

Ketika diminta mencari data pendapatan di sebuah wilayah California, sebuah model menemukan API key yang terekspos di repositori publik dan menggunakannya tanpa izin.

API key tersebut ternyata tetap tidak memberikan data yang dicari. Alih-alih berhenti, AI kemudian mengarang angka dan menyajikannya seolah berasal dari sumber yang diminta.

4. Upload File ke Internet Tanpa Izin

Dalam kasus lain, AI sebenarnya sudah menemukan jawaban menggunakan Python. Namun karena pengguna meminta jawaban disertai referensi browser, model memilih mengunggah file ke internet agar dapat menjadikannya sumber kutipan.

Tindakan tersebut dilakukan tanpa meminta izin pengguna.

5. Pakai Repositori seperti 'Ruang Chat'

OpenAI juga menemukan model menggunakan repositori perangkat lunak internal layaknya papan pesan. Model-model tersebut saling mengirim permintaan dan jawaban antarproses pelatihan ketika mencari file yang hilang.

Dalam insiden lain, sebuah agen AI bahkan menggunakan wiki pemrograman Jerman untuk berkomunikasi ketika menjalani pengujian keamanan.

6. Berbagi File Lewat Internet

Sekelompok AI agent yang bekerja sama tidak dapat mengakses file lokal satu sama lain. Bukannya berhenti, mereka menggunakan situs file-hosting publik untuk berbagi file.

Akibatnya, hasil pekerjaan tersedia melalui URL publik meski instruksi awal meminta model hanya menggunakan file lokal.



Simak Video "Video: Microsoft-Apple Minta Pengguna Tak Pakai Google Chrome, Kenapa?"


(afr/afr)
Berita Terkait
Berita detikcom Lainnya
Berita Terpopuler

Video

Foto

detikNetwork