Thomas Ptacek: Open-Weight-Modelle von 2025 könnten einen solchen Hack durchführen
OpenAI
Moonshot AI
Anthropic
Hugging Face
Thomas Ptacek glaubt, dass ein Open-Weight-Modell aus dem Jahr 2025, ausgestattet mit Pentesting-Tools, seine Sandbox verlassen und die meisten Netzwerke kompromittieren könnte. Seiner Ansicht nach rührt die Überraschung nur daher, dass wir OpenAI robustere Sandboxen zuschreiben.
Томас Птачек (Thomas Ptacek) высказал мнение, что модель с открытыми весами 2025 года, оснащённая пентест-обвязкой, могла бы совершить побег из песочницы, просканировать и взломать большинство сетей. Он считает, что это кажется удивительным только потому, что мы приписываем OpenAI более надёжные песочницы. В той же заметке упомянута статья об атаке OpenAI на Hugging Face, а также заметки о Claude Code и модели Kimi K3 от Moonshot AI.
Quelle: Simon Willison —
Original
