Trận chiến AI: Chúng tôi đã đối đầu 4 tác nhân tấn công với MaxPatrol O2 như thế nào và ai đã thắng
Positive Technologies
DeepSeek
Anthropic
Positive Technologies đã tiến hành một thử nghiệm tại căn cứ mạng Standoff, đối đầu bốn tác nhân tấn công AI tự động với hệ thống phòng thủ MaxPatrol O2 của họ. Các tác nhân AI đã thực hiện thành công tất cả các kịch bản tấn công quan trọng, với HexStrike AI (sử dụng DeepSeek V4 Pro) hoạt động tốt nhất. MaxPatrol O2 đã tái tạo hiệu quả các chuỗi tấn công, đạt điểm số lên tới 0,73 trong các chỉ số.
Positive Technologies đã tổ chức một trận chiến mạng tại trường bắn Standoff, nơi bốn tác nhân AI tấn công tự động nhắm vào mạng doanh nghiệp được bảo vệ bởi MaxPatrol O2. Các tác nhân tấn công bao gồm: OpenCode + HexStrike AI (DeepSeek V4 Pro), OpenCode + NyxStrike (GLM 5.1), PentAGI (GLM 5.1) và Yasen (Anthropic Haiku 4.5 + Opus 4.6). Tất cả các tác nhân đều bắt đầu bằng cách khai thác CVE-2024-11680 trong ProjectSend để giành quyền truy cập ban đầu, sau đó leo thang đặc quyền, di chuyển ngang và thực hiện các sự kiện quan trọng khác nhau: đánh cắp tệp tin bảo mật, thao túng dữ liệu hàng tồn kho, trích xuất tài liệu chiến lược và lấy thông tin đăng nhập của người vận hành SCADA. Thời gian tấn công dao động từ 40 phút đến vài giờ. HexStrike AI đạt tỷ lệ thành công cao nhất khi hoàn thành cả bốn kịch bản. MaxPatrol O2 sử dụng một tác nhân điều tra dựa trên mô hình ngôn ngữ lớn để tái tạo lại chuỗi tiêu diệt, tính điểm dựa trên độ chính xác trình tự (Sequence Accuracy - SA) và độ tương đồng cấu trúc (Structural Similarity - SJS). Điểm số tốt nhất của nó là 0,73 trên 1. Thí nghiệm cho thấy các tác nhân AI có thể tự động thực hiện các cuộc tấn công thực tế, nhưng thường cần có sự can thiệp của con người trong vòng lặp để hiệu chỉnh. Hệ thống phòng thủ đã xác định thành công hầu hết các bước tấn công và ghi lại thông tin đăng nhập cũng như quá trình chuyển đổi máy chủ.
Nguồn: Habr — хаб ИИ —
bản gốc
