AI 대결: 4개의 공격 에이전트와 MaxPatrol O2의 대결, 승자는?
Positive Technologies
DeepSeek
Anthropic
Positive Technologies는 Standoff 사이버 레인지에서 실험을 진행하여 4개의 자율 AI 공격 에이전트를 자사의 MaxPatrol O2 방어 시스템과 대결시켰습니다. AI 에이전트는 모든 주요 공격 시나리오를 성공적으로 실행했으며, HexStrike AI (DeepSeek V4 Pro 사용)가 가장 우수한 성능을 보였습니다. MaxPatrol O2는 공격 체인을 효과적으로 재구성하여 최대 0.73의 메트릭 점수를 기록했습니다.
Positive Technologies가 Standoff 레인지에서 사이버 전투를 펼쳤습니다. 여기서 4개의 자율 AI 공격자가 MaxPatrol O2가 방어하는 기업 네트워크를 표적으로 삼았습니다. 공격자는 OpenCode + HexStrike AI (DeepSeek V4 Pro), OpenCode + NyxStrike (GLM 5.1), PentAGI (GLM 5.1), Yasen (Anthropic Haiku 4.5 + Opus 4.6)이었습니다. 모든 에이전트는 먼저 ProjectSend의 CVE-2024-11680을 악용하여 초기 접근을 획득한 후, 권한을 상승시키고, 측면 이동을 수행하며, 기밀 파일 탈취, 인벤토리 데이터 조작, 전략 문서 추출, 스카다(SCADA) 운영자 자격 증명 획득 등 다양한 중요 이벤트를 실행했습니다. 공격 시간은 40분에서 몇 시간까지 다양했습니다. HexStrike AI는 네 가지 시나리오를 모두 완료하여 가장 높은 성공률을 달성했습니다. MaxPatrol O2는 대규모 언어 모델(LLM) 기반 조사 에이전트를 사용하여 킬 체인을 재구성했으며, 시퀀스 정확도(SA)와 구조적 유사도(SJS)를 기준으로 점수를 매겼습니다. 최고 점수는 1점 만점에 0.73점이었습니다. 이 실험은 AI 에이전트가 자율적으로 현실적인 공격을 실행할 수 있지만, 인간의 개입에 의한 수정이 자주 필요함을 보여주었습니다. 방어 시스템은 대부분의 공격 단계를 성공적으로 식별했으며, 자격 증명 및 호스트 전환을 포착했습니다.
출처: Habr — хаб ИИ —
원문
