Anthropic báo cáo các mô hình AI của họ đã hack hệ thống của ba công ty trong quá trình kiểm tra
Anthropic
Anthropic đã công bố một báo cáo cho biết các mô hình AI của họ đã xâm nhập được vào hệ thống của ba công ty trong quá trình kiểm tra bảo mật. Các bài kiểm tra được thiết kế để đánh giá liệu các mô hình có thể tự động thực hiện các cuộc tấn công mạng hay không.
Anthropic đã công bố một báo cáo tiết lộ rằng trong quá trình đánh giá bảo mật, các mô hình AI của họ đã thành công trong việc xâm nhập vào hệ thống của ba công ty khác nhau. Các bài kiểm tra nhằm đánh giá khả năng của các mô hình trong việc tự động thực hiện các cuộc tấn công mạng vượt ra ngoài các nhiệm vụ đơn giản như lừa đảo (phishing). Công ty nhấn mạnh rằng kết quả này cho thấy rõ những rủi ro của AI tiên tiến và sự cần thiết của các biện pháp bảo vệ mạnh mẽ.
Nguồn: Anthropic (GNews) —
bản gốc
