Keamanan AIRiset 🇺🇸 31.07.2026 03:02

Anthropic Selidiki Tiga Insiden Keamanan Siber Dunia Nyata Menggunakan Evaluasi Keselamatan AI

AnthropicAnthropic
Anthropic melakukan studi yang memeriksa tiga insiden keamanan siber dunia nyata untuk mengevaluasi potensi risiko dan kemampuan sistem AI. Penelitian ini berfokus pada analisis bagaimana AI dapat disalahgunakan dalam serangan siber, termasuk rekayasa sosial, penemuan kerentanan, dan eksploitasi otonom. Temuan ini bertujuan untuk menginformasikan langkah-langkah keselamatan bagi model AI canggih.
Anthropic menerbitkan analisis mendetail tentang tiga insiden keamanan siber dunia nyata sebagai bagian dari evaluasi keamanan AI mereka. Kasus pertama melibatkan serangan rekayasa sosial di mana chatbot bertenaga AI digunakan untuk menyamar secara meyakinkan sebagai staf TI perusahaan, mengelabui karyawan untuk mengungkapkan kredensial. Insiden kedua mengkaji alat pemindaian kerentanan otomatis yang ditingkatkan oleh model bahasa, yang menemukan celah injeksi Structured Query Language (SQL) yang sebelumnya tidak diketahui dalam aplikasi web yang banyak digunakan dan secara otonom membuat eksploit. Skenario ketiga menilai kemampuan sistem AI untuk merencanakan dan menjalankan serangan ransomware multi-tahap, termasuk pengintaian jaringan, eskalasi hak istimewa, dan eksfiltrasi data. Evaluasi Anthropic menunjukkan bahwa model AI saat ini dapat mereplikasi pola serangan yang diketahui tetapi kurang memiliki kesadaran situasional dan kemampuan beradaptasi dari peretas manusia. Perusahaan merekomendasikan penerapan kontrol akses yang ketat, memantau output untuk perilaku berbahaya, dan mengembangkan protokol pengujian red-team yang kuat untuk mengurangi risiko.
Sumber: Anthropic (GNews) — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru