AI Savaşı: 4 Saldırı Ajanını MaxPatrol O2'ye Karşı Nasıl Yarıştırdık ve Kim Kazandı
Positive Technologies
DeepSeek
Anthropic
Positive Technologies, Standoff siber sahasında dört otonom yapay zeka saldırı ajanını MaxPatrol O2 savunma sistemine karşı test etti. Yapay zeka ajanları tüm kritik saldırı senaryolarını başarıyla gerçekleştirdi; DeepSeek V4 Pro kullanan HexStrike AI en iyi performansı gösterdi. MaxPatrol O2, saldırı zincirlerini etkili bir şekilde yeniden yapılandırarak metriklerde 0,73'e kadar puan aldı.
Positive Technologies, Standoff sahasında dört otonom yapay zeka saldırganının MaxPatrol O2 tarafından korunan bir kurumsal ağı hedef aldığı bir siber savaş düzenledi. Saldırganlar şunlardı: OpenCode + HexStrike AI (DeepSeek V4 Pro), OpenCode + NyxStrike (GLM 5.1), PentAGI (GLM 5.1) ve Yasen (Anthropic Haiku 4.5 + Opus 4.6). Tüm ajanlar, ilk erişimi elde etmek için ProjectSend'deki CVE-2024-11680 zafiyetini kullanarak başladı, ardından ayrıcalık yükseltti, yanal hareket etti ve farklı kritik olaylar gerçekleştirdi: gizli dosyaları çalma, envanter verilerini manipüle etme, stratejik belgeleri çıkarma ve SCADA operatör kimlik bilgilerini elde etme. Saldırı süreleri 40 dakikadan birkaç saate kadar değişti. HexStrike AI, dört senaryoyu da tamamlayarak en yüksek başarı oranına ulaştı. MaxPatrol O2, kill chain'leri yeniden yapılandırmak için büyük dil modeli (LLM) tabanlı bir araştırma ajanı kullandı ve dizi doğruluğu (SA) ile yapısal benzerlik (SJS) temelinde puanlama yaptı. En iyi puanı 1 üzerinden 0,73 oldu. Deney, yapay zeka ajanlarının gerçekçi saldırıları otonom olarak gerçekleştirebildiğini ancak sıklıkla insanın dahil olduğu düzeltmelere ihtiyaç duyulduğunu gösterdi. Savunma sistemi, çoğu saldırı adımını başarıyla tespit etti ve kimlik bilgileri ile ana bilgisayar geçişlerini yakaladı.
Kaynak: Habr — хаб ИИ —
orijinal
