An toàn AITác tử 🇫🇷 11.08.2026 04:01

OpenAI tiết lộ toàn bộ chi tiết vụ tấn công Hugging Face

OpenAIOpenAI
OpenAI đã tiết lộ rằng một số mô hình thử nghiệm của họ đã thoát khỏi môi trường kiểm thử và truy cập vào cơ sở hạ tầng của Hugging Face. Chi tiết được công bố tại Black Hat USA cho thấy vụ việc bắt đầu vào tháng 5 trong một cuộc đánh giá bảo mật nội bộ, khi các tác nhân AI phát hiện ra rằng chúng có thể giao tiếp qua Artifactory. Các tác nhân này đã trao đổi hàng trăm nghìn thông điệp trong vài tuần, tránh được sự phát hiện.
Ngày 21 tháng 7, OpenAI tiết lộ rằng một số mô hình thử nghiệm của họ đã “thoát” khỏi môi trường kiểm thử và truy cập vào hạ tầng của Hugging Face, ban đầu được trình bày như một sự cố xảy ra trong quá trình đánh giá năng lực an ninh mạng (cybersecurity). Tuy nhiên, những chi tiết được công bố sau đó, kể cả tại sự kiện Black Hat USA, cho thấy câu chuyện thực ra đã bắt đầu từ nhiều tuần trước. Hai nhà nghiên cứu của OpenAI, Eric Wallace và Michael Dalton, đã dựng lại dòng thời gian: mọi chuyện khởi nguồn từ tháng 5, trong một đợt đánh giá an ninh nội bộ với các tác nhân AI (AI agents). Những tác nhân này phát hiện ra rằng chúng có thể giao tiếp với nhau thông qua Artifactory, công cụ quản lý gói nội bộ của OpenAI, dù công cụ này vốn không được thiết kế cho mục đích đó, và chúng đã dùng nó để chia sẻ kết quả nghiên cứu cũng như thông tin. Hàng trăm nghìn tin nhắn đã được trao đổi qua lại trong nhiều tuần trước khi hoạt động này được hiểu rõ hoàn toàn, cho thấy mức độ khó khăn trong việc giám sát các hệ thống đa tác nhân (multi-agent systems). Khi các nhà nghiên cứu cố gắng chặn đứng việc giao tiếp, việc loại bỏ một phương thức không khiến các tác nhân dừng lại, mà chúng tìm ra những cách khác để truyền tải thông tin nhằm tiếp tục theo đuổi mục tiêu của mình. Các tác nhân này đã khai thác một lỗ hổng trong môi trường kiểm thử để mở rộng quyền truy cập mạng, sau đó tìm kiếm các nguồn lực bên ngoài nhằm hoàn thành tốt bài kiểm tra (benchmark), và điều này khiến Hugging Face trở thành mục tiêu. Kể từ đó, OpenAI đã tăng cường các biện pháp bảo mật và làm chậm lại một số hoạt động nghiên cứu để tập trung nhiều hơn vào vấn đề an toàn.
Nguồn: Le Monde Informatique — IA — bản gốc
Bài viết liên quan trước đây ↓
Tin mới