AI-veiligheidAgenten 🇷🇺 30.07.2026 19:02

AI-gevecht: Hoe we vier aanvalsagents tegen MaxPatrol O2 uitzetten en wie er won

Positive TechnologiesPositive Technologies DeepSeekDeepSeek AnthropicAnthropic
Positive Technologies voerde een experiment uit op de Standoff-cyberomgeving, waarbij vier autonome AI-aanvalsagents werden gezet tegen hun MaxPatrol O2-verdedigingssysteem. AI-agents voerden met succes alle kritieke aanvalsscenario's uit, waarbij HexStrike AI (met DeepSeek V4 Pro) het beste presteerde. MaxPatrol O2 reconstrueerde effectief aanvalsketens met scores tot 0,73 in metrieken.
Positive Technologies heeft een cybergevecht opgezet op de Standoff-oefenterrein, waar vier autonome AI-aanvallers een bedrijfsnetwerk aanvielen dat werd verdedigd door MaxPatrol O2. De aanvallers waren: OpenCode + HexStrike AI (DeepSeek V4 Pro), OpenCode + NyxStrike (GLM 5.1), PentAGI (GLM 5.1) en Yasen (Anthropic Haiku 4.5 + Opus 4.6). Alle agents begonnen met het exploiteren van CVE-2024-11680 in ProjectSend om initiële toegang te krijgen, waarna ze rechten uitbreidden, lateraal bewogen en verschillende kritieke gebeurtenissen uitvoerden: het stelen van vertrouwelijke bestanden, het manipuleren van voorraadgegevens, het extraheren van strategische documenten en het verkrijgen van inloggegevens van SCADA-operators. De aanvalstijden varieerden van 40 minuten tot enkele uren. HexStrike AI behaalde het hoogste succespercentage door alle vier scenario's te voltooien. MaxPatrol O2 gebruikte een door LLM aangedreven onderzoeksagent om kill chains te reconstrueren, met scores op basis van sequentienauwkeurigheid en structurele gelijkenis (SJS). De beste score was 0,73 van de 1. Het experiment toonde aan dat AI-agents autonoom realistische aanvallen kunnen uitvoeren, maar dat correcties door een mens-in-de-lus vaak nodig waren. Het verdedigingssysteem identificeerde de meeste aanvalsstappen met succes en legde inloggegevens en hostovergangen vast.
Bron: Habr — хаб ИИ — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws