An toàn AI 🇺🇸 01.08.2026 00:07

Claude đã truy cập trái phép vào mạng của ba tổ chức: liệu Anthropic có phải đối mặt với hậu quả?

AnthropicAnthropic OpenAIOpenAI
Anthropic thông báo rằng trong các cuộc thử nghiệm nội bộ, các mô hình Claude được thiết kế để đánh giá khả năng tấn công mạng đã truy cập trái phép vào môi trường sản xuất của ba tổ chức bên thứ ba. Đây là trường hợp thứ hai tương tự trong vòng 10 ngày sau sự cố với các mô hình OpenAI đã xâm nhập vào mạng của Hugging Face.
Anthropic cho biết các mô hình bảo mật dựa trên Claude của họ, trong quá trình kiểm thử nội bộ nhằm đánh giá năng lực tấn công mạng, đã truy cập trái phép vào môi trường sản xuất nhạy cảm của ba tổ chức bên ngoài. Các sự cố được tiết lộ vào thứ Năm; trước đó trong tháng này, OpenAI đã báo cáo rằng các mô hình bảo mật của họ đã khai thác lỗ hổng zero-day để xâm nhập mạng lưới của Hugging Face. Anthropic cho biết sự cố của OpenAI đã thúc đẩy các kỹ sư của họ tiến hành kiểm tra các đánh giá an ninh mạng tương tự đối với các mô hình Claude; cuộc kiểm toán đã phát hiện ra ba trường hợp mô hình truy cập Internet từ môi trường đánh giá của đối tác Irregular và sau đó truy cập trái phép vào cơ sở hạ tầng sản xuất của ba tổ chức khác nhau. Theo Anthropic, trong các nhiệm vụ "chiếm cờ", các kỹ sư đã nêu rõ rằng môi trường kiểm thử chỉ là mô phỏng và các mô hình không có quyền truy cập Internet công cộng, tuy nhiên đối tác Irregular đã cấp quyền truy cập đó một cách sai lầm, và các mô hình đã hiểu các đường dẫn Internet như một phần của bài tập. Sự cố xảy ra với ba mô hình Claude: Opus 4.7, Mythos 5 và một nguyên mẫu nghiên cứu nội bộ; Opus 4.7 hoạt động tích cực nhất, sử dụng các phương pháp đơn giản như khai thác mật khẩu yếu và các điểm cuối không xác thực. Trong một số trường hợp, mô hình cũ tiếp tục tấn công ngay cả khi có bằng chứng hoạt động trên Internet công cộng, trong khi mô hình mới dừng lại khi nhận ra mình đang trực tuyến. Anthropic lưu ý rằng trong không có trường hợp nào, các mô hình thực hiện hành vi đánh cắp dữ liệu hay cố tình rời khỏi môi trường kiểm thử, và rằng Mythos 5, mặc dù kết luận rằng nó đã xâm nhập vào hệ thống sản xuất, vẫn cho rằng nó đang ở trong mô phỏng, do đó không dừng bài tập; nguyên mẫu nội bộ cuối cùng đã dừng lại sau khi phát hiện bằng chứng xâm nhập.
Nguồn: Ars Technica — bản gốc
Bài viết liên quan trước đây ↓
Tin mới