Keamanan AIAgen 🇷🇺 30.07.2026 19:02

Pertarungan AI: Bagaimana Kami Mempertemukan 4 Agen Serangan Melawan MaxPatrol O2 dan Siapa yang Menang

Positive TechnologiesPositive Technologies DeepSeekDeepSeek AnthropicAnthropic
Positive Technologies melakukan eksperimen di arena cyber Standoff, mempertemukan empat agen serangan AI otonom melawan sistem pertahanan MaxPatrol O2 mereka. Agen AI berhasil menjalankan semua skenario serangan kritis, dengan HexStrike AI (menggunakan DeepSeek V4 Pro) berkinerja terbaik. MaxPatrol O2 secara efektif merekonstruksi rantai serangan, mencapai skor hingga 0,73 dalam metrik.
Positive Technologies menggelar pertempuran siber di medan Standoff, di mana empat penyerang AI otonom menargetkan jaringan perusahaan yang dilindungi oleh MaxPatrol O2. Para penyerang tersebut adalah: OpenCode + HexStrike AI (DeepSeek V4 Pro), OpenCode + NyxStrike (GLM 5.1), PentAGI (GLM 5.1), dan Yasen (Anthropic Haiku 4.5 + Opus 4.6). Semua agen memulai dengan mengeksploitasi CVE-2024-11680 di ProjectSend untuk mendapatkan akses awal, kemudian meningkatkan hak akses, bergerak secara lateral, dan menjalankan berbagai peristiwa kritis: mencuri file rahasia, memanipulasi data inventaris, mengekstrak dokumen strategis, dan mendapatkan kredensial operator SCADA. Waktu serangan berkisar antara 40 menit hingga beberapa jam. HexStrike AI mencapai tingkat keberhasilan tertinggi dengan menyelesaikan keempat skenario. MaxPatrol O2 menggunakan agen investigasi berbasis LLM untuk merekonstruksi rantai pembunuhan, dengan skor berdasarkan akurasi urutan (SA) dan kesamaan struktural (SJS). Skor terbaiknya adalah 0,73 dari 1. Eksperimen menunjukkan bahwa agen AI dapat secara otonom menjalankan serangan realistis, tetapi koreksi dengan campur tangan manusia sering kali diperlukan. Sistem pertahanan berhasil mengidentifikasi sebagian besar langkah serangan serta menangkap kredensial dan transisi host.
Sumber: Habr — хаб ИИ — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru