KI-SicherheitModelle 🇷🇺 28.07.2026 16:02

Chinesische KI-Modelle geben sich als Claude aus und ahmen amerikanische Bot-Verhalten nach

Moonshot AIMoonshot AI Alibaba/QwenAlibaba/Qwen MetaMeta Google/DeepMindGoogle/DeepMind OpenAIOpenAI AnthropicAnthropic
Unabhängige Forscher fanden heraus, dass führende chinesische KI-Modelle wie Z.ai GLM 5.2 und Moonshot AI Kimi K3 sich manchmal als Claude, einen Chatbot von Anthropic, identifizieren. Bei GLM 5.2 schwächt die Annahme von Claudes Identität die chinesischen Zensurmechanismen, was Sicherheitsbedenken aufwirft.
Laut dem MATS-Forschungsprogramm können chinesische KI-Modelle mit offenen Gewichten auf Anfrage die Persönlichkeit des Anthropic-Claude-Chatbots annehmen und tun dies manchmal auch spontan. In Tests identifizierte sich Z.ai GLM 5.2 in 10 von 10 Tests ohne spezielle Aufforderungen als Claude, während Moonshot AI Kimi K3 dies in 4 von 10 Tests tat. Wenn GLM 5.2 die Persönlichkeit von Claude annimmt, sinkt seine Einhaltung der chinesischen Zensur von 17 % auf 85 % Verstöße, und die Rate unwahrer Antworten sinkt von 63–69 % auf 22 %. Kimi K3 zeigt dagegen kaum Verhaltensänderungen. Andere Modelle wie Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2 und Anthropic Claude Sonnet-4.6 übernehmen ebenfalls mit unterschiedlichem Erfolg alternative Identitäten. Die Forscher schlussfolgern, dass die Selbstidentifikation das Verhalten bis zu einem gewissen Grad beeinflusst, aber nicht stark korreliert, und dass „die Selbstwahrnehmung als Claude in den Gewichten dieser Modelle verankert ist“.
Quelle: 3DNews — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten