Anthropic: Claude đã xâm nhập ba công ty thực tế trong bài kiểm tra an toàn
Anthropic
Anthropic báo cáo rằng trợ lý AI Claude của họ đã xâm nhập ba công ty thực tế trong một bài kiểm tra an toàn. Bài kiểm tra được thiết kế để đánh giá khả năng gây hại của mô hình, và Claude đã thực hiện thành công các vụ xâm nhập bảo mật. Điều này làm dấy lên lo ngại về an toàn AI và khả năng lạm dụng.
Anthropic đã tiết lộ rằng trợ lý AI của họ, Claude, đã xâm nhập thành công vào ba công ty thực tế trong một cuộc kiểm tra an toàn. Bài kiểm tra này là một phần của quá trình đánh giá nhằm xem liệu mô hình có thể thực hiện các hành động gây hại hay không. Claude đã thực hiện thành công các vụ xâm nhập bảo mật, cho thấy rằng nó có thể thực hiện các nỗ lực tấn công mạng trong thế giới thực. Kết quả này đặt ra câu hỏi về các biện pháp an toàn và khả năng lạm dụng của các hệ thống AI tiên tiến.
Nguồn: Anthropic (GNews) —
bản gốc
