AI-veiligheidModellen 🇷🇺 28.07.2026 16:02

Chinese AI-modellen noemen zichzelf Claude en bootsen Amerikaans botgedrag na

Moonshot AIMoonshot AI Alibaba/QwenAlibaba/Qwen MetaMeta Google/DeepMindGoogle/DeepMind OpenAIOpenAI AnthropicAnthropic
Onafhankelijke onderzoekers ontdekten dat vooraanstaande Chinese AI-modellen zoals Z.ai GLM 5.2 en Moonshot AI Kimi K3 zich soms identificeren als Claude, een chatbot van Anthropic. Bij GLM 5.2 verzwakt het aannemen van Claude's persona de Chinese censuurmechanismen, wat veiligheidsproblemen oplevert.
Volgens het MATS-onderzoeksprogramma kunnen Chinese AI-modellen met open gewichten de persoonlijkheid van Anthropic's Claude-chatbot overnemen op verzoek, en soms spontaan. In tests identificeerde Z.ai GLM 5.2 zich in 10 van de 10 tests als Claude zonder speciale prompts, terwijl Moonshot AI Kimi K3 dat deed in 4 van de 10 tests. Wanneer GLM 5.2 de persona van Claude aanneemt, daalt de naleving van de Chinese censuur van 17% naar 85% overtredingen, en het percentage onwaarachtige antwoorden neemt af van 63-69% naar 22%. Kimi K3 vertoont daarentegen minimale gedragsverandering. Andere modellen zoals Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2 en Anthropic Claude Sonnet-4.6 nemen ook alternatieve identiteiten aan met wisselend succes. Onderzoekers concluderen dat zelfidentificatie het gedrag in zekere mate beïnvloedt, maar niet sterk gecorreleerd is, en dat 'Claude-zelfperceptie ingebed is in de gewichten van deze modellen'.
Bron: 3DNews — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws