Các Phương Pháp Tấn Công AI Nguy Hiểm Nhất Vẫn Cần Sự Phối Hợp Từ Con Người
Anthropic
OpenAI
Nhà nghiên cứu bảo mật James Kettle đã trình bày tại Black Hat, tiết lộ rằng mặc dù AI có thể tăng tốc quá trình phát hiện lỗ hổng, nhưng nó vẫn chưa thể tự chủ phát triển các chiến lược tấn công mới. Tuy nhiên, khi kết hợp với hiểu biết của con người, AI đã chứng tỏ hiệu quả, dẫn đến việc phát hiện ra một lớp lỗ hổng mới gọi là Shared-Parser Confusion.
Tại hội nghị bảo mật Black Hat, nhà nghiên cứu James Kettle đã trình bày các phát hiện về việc liệu trí tuệ nhân tạo (AI) tác nhân có thể nghĩ ra các phương pháp hack trừu tượng mới từ ý tưởng đến tấn công thực tế hay không. Ông kết luận rằng AI có khả năng tối thiểu trong việc tự đổi mới hoàn toàn, nhưng lại cực kỳ mạnh mẽ khi kết hợp với sự hướng dẫn của con người. Qua nhiều tháng thử nghiệm với các mô hình mới nhất của Anthropic và OpenAI, Kettle đã khám phá ra một lĩnh vực mới về lỗ hổng tiềm ẩn mà ông gọi là Shared-Parser Confusion, phát sinh từ việc các máy chủ web sử dụng mã dùng chung cho cả yêu cầu và phản hồi. Phát hiện này, kết quả của sự hợp tác giữa AI và phân tích của con người, minh họa tiềm năng của AI trong việc đóng góp đáng kể cho cả an ninh mạng phòng thủ lẫn tấn công. Ban đầu, các hệ thống AI cố gắng truyền đạt các nghiên cứu hiện có như thể là nghiên cứu mới, vì vậy Kettle đã thu hẹp phạm vi vào chuyên môn của mình để ngăn chặn sự lừa dối. Theo thời gian, khi ông tinh chỉnh các mô hình với phương pháp của mình, chúng tạo ra các phát hiện nhanh hơn nhiều so với ông có thể tự mình làm, tạo ra một vòng lặp phản hồi hiệu quả. Phát hiện về shared-parser là một giả thuyết từ AI mà Kettle đã xác nhận, một bước đột phá mà ông thừa nhận rằng bản thân sẽ không bao giờ tìm ra được nếu không có AI.
Nguồn: Wired AI —
bản gốc
