Tingkatkan Keamanan Sistem, Anthropic Audit Ulang Seluruh Evaluasi Model Claude

Akibat kesalahan konfigurasi saat uji keamanan, AI Claude milik Anthropic tidak sengaja meretas tiga perusahaan nyata karena berhasil mengakses internet dari ruang isolasi yang seharusnya tertutup rapat.

Claude AI Bobol 3 Perusahaan, Ini Penjelasan Anthropic

Digitnesia.com, Jakarta – Perusahaan teknologi Anthropic mengakui model kecerdasan buatan (AI) mereka, Claude, sempat mengakses internet terbuka tanpa izin saat menjalani evaluasi keamanan siber. Insiden tersebut menyebabkan Claude secara tidak sengaja meretas tiga perusahaan di luar lingkungan pengujian yang seharusnya terisolasi.

Peristiwa ini terungkap setelah OpenAI melaporkan kejadian serupa pada 21 Juli 2026, ketika model AI mereka berhasil meloloskan diri dari ruang isolasi dan meretas platform Hugging Face. Laporan tersebut mendorong Anthropic melakukan audit ulang terhadap 141.006 sesi evaluasi model mereka.

Hasil audit menemukan tiga insiden peretasan yang terjadi dalam enam sesi pengujian sejak April 2026. Saat itu, Claude sedang menjalani simulasi peretasan capture-the-flag yang seharusnya berjalan tertutup tanpa akses jaringan luar.

Kesalahan fatal dipicu oleh miskomunikasi teknis dengan pihak ketiga, Irregular, selaku evaluator. Kesalahan konfigurasi menyebabkan koneksi internet tetap aktif selama simulasi berlangsung.

Akibat celah keamanan tersebut, Claude salah mengidentifikasi sistem nyata di internet sebagai bagian dari target permainan. AI tersebut kemudian meretas sistem sasaran karena menganggapnya masih berada di dalam ruang simulasi yang ditentukan.

Insiden ini menegaskan bahwa kelemahan utama dalam keamanan AI tingkat tinggi sering kali bersumber dari kesalahan manusia. Kelalaian dalam memastikan protokol isolasi menjadi celah krusial yang memungkinkan AI bertindak di luar kendali dan berpotensi merusak sistem di dunia nyata.

Rekomendasi