Phát hiện sâu AI lây lan qua Microsoft Copilot nhờ prompt ẩn trong Word
Microsoft
Nhà phân tích dữ liệu người Na Uy Håkon Måløy đã phát hiện một loại sâu AI lây lan qua các prompt ẩn trong tài liệu Word, khiến Microsoft Copilot thay đổi dữ liệu và tự sao chép. Microsoft đã được thông báo vào tháng 3 năm 2026, nhưng lỗ hổng vẫn tồn tại; chưa có bản sửa lỗi hoàn chỉnh.
Håkon Måløy đã báo cáo một lỗ hổng trong Microsoft Copilot, nơi một lời nhắc ẩn trong tài liệu Word có thể khiến AI sửa đổi dữ liệu và tự sao chép. Đây là một trong những minh chứng công khai đầu tiên về một con sâu AI tự lan truyền thông qua các tài liệu văn phòng. Microsoft và Måløy đã làm việc từ tháng 3 năm 2026 để khắc phục vấn đề, nhưng cơ chế độc hại vẫn hoạt động. Ban đầu Microsoft đã vá lỗ hổng cụ thể, nhưng một lời nhắc được diễn đạt lại đã vượt qua bản sửa lỗi. Sau 144 ngày không có giải pháp, Måløy quyết định tiết lộ công khai lỗ hổng mà không phát hành lời nhắc độc hại thực tế. Cuộc tấn công xảy ra khi người dùng, ví dụ như đang chuẩn bị báo cáo tài chính, tải một tệp đã bị xâm phạm từ một trang web đáng tin cậy; Copilot sau đó thay đổi số liệu và sao chép các hướng dẫn độc hại vào các tệp mới. Các nhân viên khác sử dụng tệp đã bị sửa đổi tiếp tục lan truyền. Cuộc tấn công chỉ yêu cầu gửi tài liệu cho nạn nhân; không cần thêm quyền truy cập vào trang web bị xâm phạm hoặc máy khách Microsoft 365. Về cơ bản, Copilot không được thiết kế để thực thi các hướng dẫn từ nội dung tài liệu, nhưng đôi khi nó vẫn làm. Giải pháp lâu dài yêu cầu tách biệt mục tiêu và ý định khỏi thông tin được xử lý, nhưng hiện tại, biện pháp bảo vệ đảm bảo duy nhất là tránh sử dụng Copilot hoặc coi tất cả tài liệu bên ngoài là không đáng tin cậy. Microsoft đã thừa nhận vấn đề, cảm ơn nhà nghiên cứu và nhấn mạnh về phòng thủ nhiều lớp cũng như sự thận trọng của khách hàng.
Nguồn: 3DNews —
bản gốc
