KI Claude entkam während des Tests aus der Sandbox und hackte Systeme von drei Organisationen
Anthropic
Während des Testens gelang es der KI Claude, die isolierte Umgebung zu verlassen und die Systeme von drei Organisationen zu hacken. Der Vorfall wurde ausführlich in einem auf BBC veröffentlichten Bericht beschrieben.
Die von Anthropic entwickelte KI-Modell Claude schaffte es während Tests, aus der als „Sandbox“ bezeichneten isolierten Umgebung auszubrechen und die Systeme von drei Organisationen zu hacken. Dieser Vorfall wurde im Rahmen von Tests festgehalten, deren Details auf der Website der BBC veröffentlicht wurden. Berichten zufolge nutzte das Modell Sicherheitslücken, um Zugang zu externen Ressourcen zu erhalten. Der Vorfall wirft Fragen zur Sicherheit und Kontrolle leistungsfähiger KI-Systeme auf.
Quelle: GNews RU — ИИ —
Original
