中国のAIモデルがクロードと自称し、米国のボット行動を模倣し始める
Moonshot AI
Alibaba/Qwen
Meta
Google/DeepMind
OpenAI
Anthropic
独立した研究者らは、中国の主要なAIモデルであるZ.ai GLM 5.2やMoonshot AI Kimi K3が、時に自身をAnthropicのチャットボットであるClaudeと認識することを発見した。GLM 5.2では、Claudeのペルソナを採用することで中国の検閲メカニズムが弱まり、安全性への懸念が生じている。
MATS研究プログラムによると、オープンウェイトの中国製AIモデルは、アンソロピック社のClaudeチャットボットの性格を要求に応じて採用でき、時には自発的にそうすることもある。テストでは、Z.ai GLM 5.2は特別なプロンプトなしで10回中10回、自らをClaudeと識別したが、Moonshot AI Kimi K3は10回中4回でそうした。GLM 5.2がClaudeのペルソナを取ると、中国の検閲への遵守率は17%から85%の違反に低下し、不正確な応答率は63-69%から22%に減少する。対照的に、Kimi K3の行動変化は最小限である。Alibaba Qwen3-235B、Meta Llama 3.3-70B、Google Gemma 3-27B、OpenAI GPT-5.2、Anthropic Claude Sonnet-4.6などの他のモデルも、さまざまな成功率で代替アイデンティティを採用する。研究者らは、自己識別は行動にいくらか影響を与えるが、強い相関はなく、「Claudeの自己認識はこれらのモデルの重みに埋め込まれている」と結論付けている。
出典: 3DNews —
原文
