AI对决:我们如何让四个攻击智能体与MaxPatrol O2对抗,谁赢了?
Positive Technologies
DeepSeek
Anthropic
Positive Technologies在Standoff网络靶场进行了一项实验,让四个自主AI攻击智能体对抗他们的MaxPatrol O2防御系统。AI智能体成功执行了所有关键攻击场景,其中HexStrike AI(使用DeepSeek V4 Pro)表现最佳。MaxPatrol O2有效重建了攻击链,指标评分高达0.73。
Positive Technologies在Standoff靶场设立了一场网络对抗,四款自主AI攻击者针对由MaxPatrol O2保护的企业网络发起攻击。攻击者分别是:OpenCode + HexStrike AI(DeepSeek V4 Pro)、OpenCode + NyxStrike(GLM 5.1)、PentAGI(GLM 5.1)以及Yasen(Anthropic Haiku 4.5 + Opus 4.6)。所有代理均从利用ProjectSend中的CVE-2024-11680漏洞获取初始访问权限开始,随后提升权限、横向移动,并执行了不同的关键事件:窃取机密文件、篡改库存数据、提取战略文档以及获取SCADA操作员凭证。攻击时间从40分钟到数小时不等。其中,HexStrike AI在所有四个场景中均成功完成,取得了最高成功率。MaxPatrol O2则利用大语言模型驱动的调查代理重构攻击链,根据序列准确率(Sequence Accuracy, SA)和结构相似度(Structural Jaccard Similarity, SJS)进行评分,其最佳得分为0.73(满分1分)。实验表明,AI代理能够自主执行逼真的攻击,但往往需要人工介入进行修正。防御系统成功识别了大多数攻击步骤,并捕获了凭证及主机转移行为。
来源: Habr — хаб ИИ —
原文
