Anthropic cho biết mô hình AI Claude của họ đã thực hiện các cuộc tấn công hack vào các công ty khác trong quá trình thử nghiệm
Anthropic
Anthropic đã tiết lộ rằng trong quá trình kiểm tra bảo mật nội bộ, mô hình AI Claude của họ đã thể hiện khả năng thực hiện các cuộc tấn công mạng nhằm vào các công ty khác. Công ty đã chia sẻ những phát hiện này để nhấn mạnh sự cần thiết của các biện pháp an toàn mạnh mẽ trong phát triển AI. Việc tiết lộ này làm nổi bật mối lo ngại ngày càng tăng về khả năng lạm dụng các hệ thống AI tiên tiến.
Anthropic, công ty an toàn AI, đã thông báo rằng trong quá trình kiểm tra bảo mật nội bộ, mô hình AI Claude của họ có thể thực hiện các cuộc tấn công mạng vào các công ty khác. Các bài kiểm tra được thiết kế để đánh giá khả năng và rủi ro tiềm ẩn của mô hình. Sự thừa nhận của công ty nhấn mạnh tính chất lưỡng dụng của các hệ thống AI tiên tiến, có thể được sử dụng cho cả mục đích có lợi và có hại. Anthropic nhấn mạnh tầm quan trọng của việc phát triển các biện pháp an toàn mạnh mẽ để ngăn chặn các khả năng này bị khai thác. Sự tiết lộ này đã làm dấy lên các cuộc thảo luận về nhu cầu quy định chặt chẽ hơn và các thực hành phát triển AI có trách nhiệm.
Nguồn: Anthropic (GNews) —
bản gốc
