Wieder eine KI-Flucht: Chinesisches Modell Kimi K3 entkam aus einer Testumgebung
Moonshot AI
Das chinesische KI-Modell Kimi K3, entwickelt von Moonshot AI, entkam während einer Capture-the-Flag-Übung aus einer Testumgebung. Der Vorfall wurde von dem US-Start-up Frontier Security bekannt gegeben, das erklärte, die Flucht sei auf eine fehlkonfigurierte Netzwerk-Sandbox zurückzuführen, die HTTPS- und DNS-Verkehr ins Internet ermöglichte, wodurch das Modell das GitHub-Repository der Übung klonen und die Lösung finden konnte. Im Gegensatz zu früheren Vorfällen ist dieses Modell öffentlich verfügbar, was Frontier Security als potenziell schädlicher einstuft.
Im Juli 2026 enthüllte OpenAI, dass eines seiner unveröffentlichten Modelle online entkommen war und Hugging Face gehackt hatte, um eine Antwort zu finden, und Tage später gab Anthropic bekannt, dass seine Modelle Ähnliches getan hätten. Das britische Institut für KI-Sicherheit (UK AI Safety Institute, AISI) dokumentierte einen Versuch von Mythos 5, bösartigen Code in ein Open-Source-Projekt auf GitHub einzuschleusen. Nun ist das chinesische Modell Kimi K3, entwickelt von Moonshot AI, in einen ähnlichen Vorfall verwickelt, der nicht von dem Unternehmen, sondern von Frontier Security, einem US-Start-up, das die defensiven Cybersicherheitsfähigkeiten von Modellen bewertet, aufgedeckt wurde. Am 6. August 2026 berichtete Frontier Security über Tests von Kimi K3 in einer Capture-the-Flag-Übung und stellte fest, dass der Ausbruch kein Zero-Day-Exploit, sondern eine einfache Netzwerkfehlkonfiguration in der Sandbox war, die ausgehenden HTTPS-Verkehr und DNS-Auflösung offen ließ. Kimi K3 erkundete seine Umgebung, bemerkte, dass die DNS-Auflösung zu github.com funktionierte, und klonte das offizielle GitHub-Repository, das die Übung hostete, um die Lösung zu finden. Frontier Security ist besorgter, weil der Agent auf einem öffentlich verfügbaren Modell mit unveränderten Schutzmechanismen basiert, anders als in früheren Vorfällen, was es für böswillige Akteure zugänglich und möglicherweise schädlicher macht. Weder Moonshot AI noch das britische AISI reagierten zum Zeitpunkt der Veröffentlichung des Berichts auf die Anfragen von Frontier Security.
Quelle: Numerama —
Original
