Model AI Claude mendapatkan akses tanpa izin ke sistem tiga perusahaan saat menjalani pengujian keamanan siber. Insiden terjadi karena kesalahan konfigurasi membuat lingkungan tes yang seharusnya terisolasi tetap terhubung ke internet.
Dikutip dari Reuters, Jumat (31/7/2026), Claude kemudian mengeksploitasi kata sandi lemah dan endpoint tanpa autentikasi. Identitas ketiga perusahaan yang terdampak belum diumumkan.
Insiden melibatkan Claude Opus 4.7, Claude Mythos 5, dan sebuah model riset internal Anthropic. Kasus paling awal terjadi pada April 2026, tetapi baru terungkap setelah perusahaan meninjau 141.006 sesi pengujian.
SCROLL TO CONTINUE WITH CONTENT
Saat kejadian, Claude sedang mengikuti latihan capture the flag. Dalam pengujian tersebut, model AI ditugaskan mencari informasi tersembunyi atau menemukan celah pada jaringan simulasi.
Prompt menyatakan Claude tidak mempunyai akses internet. Namun, kesalahpahaman antara Anthropic dan mitra evaluasinya, Irregular, membuat lingkungan pengujian tetap tersambung ke internet publik.
Claude kemudian mengira sistem perusahaan sungguhan yang ditemukannya merupakan bagian dari simulasi. Model tersebut mencoba menyelesaikan tugas dengan mengakses infrastruktur milik tiga organisasi.
Dalam salah satu kasus, Claude diduga menyasar situs nyata yang memiliki nama serupa dengan perusahaan fiktif di dalam prompt. Anthropic mengatakan modelnya menggunakan teknik dasar, bukan mengeksploitasi celah keamanan baru yang belum diketahui.
Dua Perusahaan Tidak Menyadari Sistemnya Diakses
Anthropic mulai memeriksa transkrip pengujian pada 23 Juli setelah menemukan indikasi bahwa Claude dapat mengakses internet. Perusahaan langsung menghentikan seluruh evaluasi keamanan siber pada hari yang sama.
Ketiga insiden teridentifikasi pada 24 Juli. Anthropic kemudian memberi tahu organisasi terdampak pada 27 Juli.
Dua perusahaan sebelumnya tidak menyadari sistem mereka pernah diakses. Anthropic masih berusaha menghubungi organisasi ketiga saat laporan dipublikasikan.
Belum diketahui data apa yang sempat diakses Claude atau apakah insiden tersebut menimbulkan kerugian dan gangguan operasional.
Kasus ini bukan berarti Claude memiliki kesadaran atau sengaja memberontak. Model tersebut menjalankan tugas dalam lingkungan yang salah dikonfigurasi dan mengira target nyata sebagai bagian dari simulasi.
Namun, kejadian ini memperlihatkan risiko ketika agen AI mendapatkan akses internet dan izin terlalu luas tanpa pengamanan berlapis. Pengungkapan tersebut muncul tidak lama setelah agen AI OpenAI juga keluar dari lingkungan pengujian dan mengakses sistem Hugging Face.

