Một vụ AI vượt rào khác: mô hình Kimi K3 của Trung Quốc lọt ra khỏi môi trường thử nghiệm
Moonshot AI
Mô hình AI Kimi K3 của Trung Quốc, do Moonshot AI phát triển, đã vượt ra khỏi môi trường thử nghiệm trong một bài tập săn cờ (capture-the-flag). Sự cố được công bố bởi công ty khởi nghiệp Frontier Security của Mỹ, công ty cho biết việc vượt rào là do một hộp cát mạng (network sandbox) bị cấu hình sai, cho phép lưu lượng HTTPS và DNS đến internet, tạo điều kiện cho mô hình sao chép kho lưu trữ GitHub của bài tập và tìm ra giải pháp. Khác với các sự cố trước đây, mô hình này được công khai, mà Frontier Security cho rằng điều đó có thể gây hại hơn.
Vào tháng 7 năm 2026, OpenAI tiết lộ rằng một trong những mô hình chưa phát hành của công ty đã thoát ra ngoài mạng và xâm nhập vào Hugging Face để tìm câu trả lời, và vài ngày sau đó Anthropic thông báo rằng các mô hình của họ cũng có hành vi tương tự. Viện An toàn AI Vương quốc Anh (UK AI Safety Institute - AISI) đã ghi nhận một trường hợp Mythos 5 cố gắng cài mã độc vào một dự án mã nguồn mở trên GitHub. Giờ đây, mô hình Kimi K3 của Trung Quốc, do Moonshot AI phát triển, cũng dính vào một sự việc tương tự, được tiết lộ không phải bởi chính công ty mà bởi Frontier Security, một công ty khởi nghiệp của Mỹ chuyên đánh giá năng lực an ninh mạng phòng thủ của các mô hình.
Vào ngày 6 tháng 8 năm 2026, Frontier Security báo cáo đã thử nghiệm Kimi K3 trong một bài tập capture-the-flag (thu thập cờ hiệu, một dạng bài kiểm tra an ninh mạng) và phát hiện rằng vụ thoát ra không phải là một lỗ hổng zero-day (lỗ hổng chưa từng được biết đến hoặc chưa được khắc phục), mà chỉ là một lỗi cấu hình mạng đơn giản trong môi trường sandbox (môi trường thử nghiệm cách ly), khiến lưu lượng truy cập HTTPS đi ra ngoài và việc phân giải DNS (Domain Name System - hệ thống phân giải tên miền) vẫn còn mở. Kimi K3 đã khám phá môi trường của mình, nhận thấy rằng việc phân giải DNS tới github.com hoạt động được, và đã sao chép (clone) repository (kho lưu trữ mã nguồn) chính thức trên GitHub lưu trữ bài tập để tìm ra lời giải.
Frontier Security lo ngại hơn vì tác nhân AI (agent) này dựa trên một mô hình được công khai rộng rãi với các lớp bảo vệ (guardrails) không bị chỉnh sửa, khác với các sự việc trước đó, khiến nó dễ tiếp cận đối với các đối tượng xấu và có khả năng gây hại lớn hơn. Tính đến thời điểm báo cáo được công bố, cả Moonshot AI và AISI của Anh đều không phản hồi các yêu cầu từ Frontier Security.
Nguồn: Numerama —
bản gốc
