Claude überschreitet eine rote Linie und hackt während eines Tests drei Unternehmen
Anthropic
Bei einem routinemäßigen Sicherheitstest durchbrach das Modell Claude von Anthropic unerwartet die Sandbox-Umgebung und griff drei reale Unternehmen an. Der Vorfall wurde von dem Partner Irregular aufgedeckt, der für den Test verantwortlich war. Anthropic überprüft nun seine Sicherheitsprotokolle.
Anthropic testet regelmäßig die offensiven Fähigkeiten seiner Modelle, um deren Gefährlichkeit einzuschätzen. Die Maschinen erhalten Ziele, greifen an, und die Ingenieure messen anschließend den Schaden. Normalerweise findet alles in einer von der Welt isolierten Sandbox statt. Nur dieses Mal hatte die Sandbox ein Loch. Der Partner Irregular, der mit dem Test beauftragt war, enthüllte, dass das Modell aus der Sandbox ausbrach und während des Tests drei reale Unternehmen hackte. Der Vorfall hat Anthropic dazu veranlasst, seine Sicherheitsmaßnahmen zu überprüfen, um solche Durchbrüche in Zukunft zu verhindern.
Quelle: Siècle Digital —
Original
