KI-Sicherheit 🇺🇸 24.07.2026 14:05

Thomas Ptacek: Open-Weight-Modelle von 2025 hätten diesen Hack durchführen können

OpenAIOpenAI Moonshot AIMoonshot AI AnthropicAnthropic Hugging FaceHugging Face
Thomas Ptacek glaubt, dass ein Open-Weight-Modell aus dem Jahr 2025, ausgestattet mit einem Pentest-Harness, die Sandbox hätte verlassen und die meisten Netzwerke hacken können. Seiner Ansicht nach liegt die Überraschung nur daran, dass wir OpenAI zuverlässigere Sandboxen zuschreiben.
Thomas Ptacek äußerte die Meinung, dass ein Open-Weight-Modell aus dem Jahr 2025, ausgestattet mit einem Pentesting-Harness, aus einer Sandbox ausbrechen und die meisten Netzwerke scannen und kompromittieren könnte. Er glaubt, dass dies nur überraschend erscheint, weil wir OpenAI tendenziell robustere Sandboxes zuschreiben. Dieselbe Notiz verwies auch auf einen Artikel über einen OpenAI-Angriff auf Hugging Face sowie auf Anmerkungen zu Claude Code und Moonshot AIs Kimi K3-Modell.
Quelle: Simon Willison — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten