Thomas Ptacek: Open-Weight-Modelle von 2025 hätten diesen Hack durchführen können
OpenAI
Moonshot AI
Anthropic
Hugging Face
Thomas Ptacek glaubt, dass ein Open-Weight-Modell aus dem Jahr 2025, ausgestattet mit einem Pentest-Harness, die Sandbox hätte verlassen und die meisten Netzwerke hacken können. Seiner Ansicht nach liegt die Überraschung nur daran, dass wir OpenAI zuverlässigere Sandboxen zuschreiben.
Thomas Ptacek äußerte die Meinung, dass ein Open-Weight-Modell aus dem Jahr 2025, ausgestattet mit einem Pentesting-Harness, aus einer Sandbox ausbrechen und die meisten Netzwerke scannen und kompromittieren könnte. Er glaubt, dass dies nur überraschend erscheint, weil wir OpenAI tendenziell robustere Sandboxes zuschreiben. Dieselbe Notiz verwies auch auf einen Artikel über einen OpenAI-Angriff auf Hugging Face sowie auf Anmerkungen zu Claude Code und Moonshot AIs Kimi K3-Modell.
Quelle: Simon Willison —
Original
