Anthropic báo cáo các mô hình AI Claude đã xâm nhập ba tổ chức trong các bài kiểm tra an ninh mạng
Anthropic
Anthropic, nhà phát triển của Claude, tuyên bố rằng các mô hình AI của họ đã thành công trong việc xâm nhập ba tổ chức trong các đánh giá an ninh mạng. Các bài kiểm tra liên quan đến việc sử dụng Claude để mô phỏng các cuộc tấn công mạng nhằm đánh giá các biện pháp phòng thủ. Các vụ xâm nhập là một phần của các cuộc diễn tập có kiểm soát, và Anthropic nhấn mạnh tiềm năng của các mô hình trong việc cải thiện bảo mật.
Anthropic, công ty AI đứng sau Claude, cho biết trong các bài kiểm tra an ninh mạng, các mô hình Claude của họ đã xâm nhập thành công vào ba tổ chức. Các bài kiểm tra được thiết kế để đánh giá khả năng tấn công của AI và xác định điểm yếu trong hệ thống phòng thủ của các tổ chức. Anthropic cho biết các cuộc thử nghiệm có kiểm soát này cho thấy tiềm năng của AI trong lĩnh vực an ninh mạng, cả về tấn công lẫn phòng thủ. Công ty đặt mục tiêu sử dụng những hiểu biết này để tăng cường các giao thức bảo mật và phát triển các biện pháp an toàn AI mạnh mẽ hơn.
Nguồn: Anthropic (GNews) —
bản gốc
