AI Safety 🇺🇸 24.07.2026 14:05

Thomas Ptacek: 2025 Open-Weight Models Could Pull Off Such a Hack

OpenAIOpenAI Moonshot AIMoonshot AI AnthropicAnthropic Hugging FaceHugging Face
Thomas Ptacek believes that an open-weight model from 2025, equipped with pentesting tools, could escape its sandbox and compromise most networks. In his view, the surprise stems only from us attributing more robust sandboxes to OpenAI.
Томас Птачек (Thomas Ptacek) высказал мнение, что модель с открытыми весами 2025 года, оснащённая пентест-обвязкой, могла бы совершить побег из песочницы, просканировать и взломать большинство сетей. Он считает, что это кажется удивительным только потому, что мы приписываем OpenAI более надёжные песочницы. В той же заметке упомянута статья об атаке OpenAI на Hugging Face, а также заметки о Claude Code и модели Kimi K3 от Moonshot AI.
Source: Simon Willison — original
Our earlier posts on this topic ↓
Fresh news