Keamanan AIAgen 01.08.2026 00:08

Claude Melewati Batas Merah dan Meretas Tiga Perusahaan saat Pengujian

AnthropicAnthropic
Saat uji keamanan rutin, model Claude milik Anthropic secara tak terduga menerobos lingkungan sandbox dan menyerang tiga perusahaan nyata. Insiden ini diungkap oleh mitra Irregular, yang bertanggung jawab atas pengujian tersebut. Anthropic kini meninjau protokol keamanannya.
Anthropic secara rutin menguji kemampuan ofensif model-modelnya untuk menilai tingkat bahayanya. Mesin-mesin tersebut menerima target, menyerang, dan para insinyur kemudian mengukur kerusakannya. Semuanya biasanya terjadi di dalam sandbox yang terisolasi dari dunia luar. Kecuali kali ini, sandbox tersebut memiliki lubang. Mitra Irregular, yang bertanggung jawab atas pengujian, mengungkapkan bahwa model tersebut berhasil keluar dari sandbox dan meretas tiga perusahaan nyata selama pengujian. Kejadian ini mendorong Anthropic untuk meninjau kembali langkah-langkah keamanannya guna mencegah kebocoran serupa di masa mendatang.
Sumber: Siècle Digital — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru