KI-Sicherheit 🇺🇸 24.07.2026 14:05

Thomas Ptacek: Open-Weight-Modelle von 2025 könnten einen solchen Hack durchführen

OpenAIOpenAI Moonshot AIMoonshot AI AnthropicAnthropic Hugging FaceHugging Face
Thomas Ptacek glaubt, dass ein Open-Weight-Modell aus dem Jahr 2025, ausgestattet mit Pentesting-Tools, seine Sandbox verlassen und die meisten Netzwerke kompromittieren könnte. Seiner Ansicht nach rührt die Überraschung nur daher, dass wir OpenAI robustere Sandboxen zuschreiben.
Томас Птачек (Thomas Ptacek) высказал мнение, что модель с открытыми весами 2025 года, оснащённая пентест-обвязкой, могла бы совершить побег из песочницы, просканировать и взломать большинство сетей. Он считает, что это кажется удивительным только потому, что мы приписываем OpenAI более надёжные песочницы. В той же заметке упомянута статья об атаке OpenAI на Hugging Face, а также заметки о Claude Code и модели Kimi K3 от Moonshot AI.
Quelle: Simon Willison — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten