An toàn AINghiên cứu 🇨🇳 12.08.2026 17:02

Bài báo AI thường niên: Cơ chế chống chưng cất của ba mô hình hàng đầu bị phá vỡ, mô hình nhỏ trích xuất chuỗi suy luận ẩn, hiện tượng bất thường Kimi-K3 tái diễn

Moonshot AIMoonshot AI
Một bài báo học thuật mới tuyên bố đã phá vỡ cơ chế chống chưng cất của ba mô hình AI hàng đầu thế giới, cho phép các mô hình nhỏ trích xuất chuỗi suy luận ẩn. Hiện tượng bất thường này đã được tái tạo với Kimi-K3.
Một bài báo nghiên cứu thường niên về trí tuệ nhân tạo (Artificial Intelligence – AI) cho biết đã có một bước đột phá toàn diện trong các cơ chế phòng thủ nhằm chống lại việc chưng cất mô hình (model distillation) đối với ba mô hình AI hàng đầu. Các nhà nghiên cứu đã chứng minh rằng những mô hình nhỏ có thể trích xuất hiệu quả chuỗi suy luận ẩn (chain-of-thought) từ các mô hình lớn hơn, qua đó làm suy yếu những biện pháp bảo vệ vốn được thiết kế để ngăn chặn hành vi trích xuất này. Hiện tượng trên đã được tái hiện thông qua một bất thường về xác suất liên quan đến Kimi-K3, một mô hình do Moonshot AI phát triển. Diễn biến này đang làm dấy lên những lo ngại về an ninh và quyền sở hữu trí tuệ đối với các hệ thống AI tiên tiến.
Nguồn: Moonshot Kimi (GNews) — bản gốc
Bài viết liên quan trước đây ↓
Tin mới