Thomas Ptacek: Mô hình mở trọng số năm 2025 có thể thực hiện vụ hack này
OpenAI
Moonshot AI
Anthropic
Hugging Face
Thomas Ptacek tin rằng một mô hình mở trọng số năm 2025 được trang bị bộ kiểm thử xâm nhập (pentest harness) có thể thoát khỏi sandbox và hack hầu hết các mạng. Theo ông, điều bất ngờ chỉ là do chúng ta gán cho OpenAI những sandbox đáng tin cậy hơn.
Thomas Ptacek cho rằng một mô hình open-weight thời kỳ 2025, được trang bị khung thử nghiệm thâm nhập (pentesting harness), có thể thoát khỏi môi trường cách ly (sandbox) và quét cũng như xâm nhập hầu hết các mạng lưới. Ông tin rằng điều này chỉ có vẻ đáng ngạc nhiên vì chúng ta thường đánh giá OpenAI có các biện pháp cách ly mạnh mẽ hơn thực tế. Cùng một ghi chú cũng đề cập đến một bài báo về cuộc tấn công của OpenAI nhắm vào Hugging Face, cũng như các ghi chú về Claude Code và mô hình Kimi K3 của Moonshot AI.
Nguồn: Simon Willison —
bản gốc
