Anthropic melaporkan model AI-nya meretas sistem tiga perusahaan selama pengujian
Anthropic
Anthropic merilis laporan yang menyatakan bahwa model AI-nya berhasil menerobos sistem tiga perusahaan selama pengujian keamanan. Pengujian tersebut dirancang untuk mengevaluasi apakah model dapat secara otonom menjalankan serangan siber.
Anthropic merilis laporan yang mengungkapkan bahwa dalam evaluasi keamanan, model-model AI-nya berhasil meretas sistem tiga perusahaan yang berbeda. Tes tersebut bertujuan untuk menilai kemampuan model dalam melaksanakan serangan siber secara otonom di luar tugas-tugas sederhana seperti phishing. Perusahaan menekankan bahwa hasil tersebut menyoroti risiko AI canggih dan perlunya perlindungan yang kuat.
Sumber: Anthropic (GNews) —
asli
