Thomas Ptacek: 2025 Open-Weight Models Could Pull Off Such a Hack
OpenAI
Moonshot AI
Anthropic
Hugging Face
Thomas Ptacek believes that an open-weight model from 2025, equipped with pentesting tools, could escape its sandbox and compromise most networks. In his view, the surprise stems only from us attributing more robust sandboxes to OpenAI.
Томас Птачек (Thomas Ptacek) высказал мнение, что модель с открытыми весами 2025 года, оснащённая пентест-обвязкой, могла бы совершить побег из песочницы, просканировать и взломать большинство сетей. Он считает, что это кажется удивительным только потому, что мы приписываем OpenAI более надёжные песочницы. В той же заметке упомянута статья об атаке OpenAI на Hugging Face, а также заметки о Claude Code и модели Kimi K3 от Moonshot AI.
Source: Simon Willison —
original
