Lỗ hổng kiến trúc trong GPT-5, Claude và Gemini bị phơi bày
OpenAI
Anthropic
Google/DeepMind
Một nhóm nghiên cứu quốc tế đã phát hiện ra lỗ hổng kiến trúc trong các khối suy luận Chuỗi suy nghĩ (Chain of Thought) được mã hóa của các mô hình AI hàng đầu như GPT-5, Claude và Gemini. Bằng cách sử dụng các mô hình anh em nhỏ hơn từ cùng nhà cung cấp, kẻ tấn công có thể giải mã và đọc toàn bộ quá trình suy luận, có khả năng làm lộ dữ liệu nhạy cảm.
Một nhóm nghiên cứu quốc tế đã phát hiện ra một lỗ hổng kiến trúc nghiêm trọng trong các khối suy luận được mã hóa của các hệ thống AI hàng đầu như GPT-5, Claude và Gemini. Các hệ thống này tạo ra một chuỗi suy nghĩ nội bộ trước khi trả lời, mà các nhà cung cấp mã hóa và gửi đến máy khách chỉ để được trả lại cùng với các truy vấn tiếp theo. Các nhà nghiên cứu phát hiện rằng OpenAI, Anthropic và Google sử dụng các khóa mã hóa toàn cầu cho các dòng mô hình của họ, nghĩa là các khối suy luận được mã hóa không gắn với một người dùng, phiên hoặc mô hình cụ thể. Điều này cho phép kẻ tấn công lấy khối suy luận được mã hóa của một mô hình hàng đầu và gửi nó đến một mô hình anh em nhỏ hơn, ít bị hạn chế hơn, mô hình này sau đó giải mã và xuất ra toàn bộ quá trình suy luận. Nhóm nghiên cứu đã phân tích các kho lưu trữ công khai và nhật ký, tìm thấy 315.320 khối suy luận được mã hóa, và đã giải mã thành công các mã định danh cá nhân, khóa API, mật khẩu và địa chỉ email. Lỗ hổng này cũng cho phép tiêm ẩn các lời nhắc và sao chép trái phép các khả năng của mô hình. Các nhà nghiên cứu đã tiết lộ phát hiện của họ cho các công ty bị ảnh hưởng, những công ty này đã bắt đầu triển khai các biện pháp đối phó; tuy nhiên, cho đến khi mã hóa được ràng buộc chặt chẽ với một phiên cụ thể, người dùng không thể giả định rằng họ được bảo vệ.
Nguồn: Heise online —
bản gốc
