Les modèles d'IA chinois commencent à se faire appeler Claude et à imiter le comportement des robots américains
Moonshot AI
Alibaba/Qwen
Meta
Google/DeepMind
OpenAI
Anthropic
Des chercheurs indépendants ont découvert que des modèles d'IA chinois de premier plan comme Z.ai GLM 5.2 et Moonshot AI Kimi K3 s'identifient parfois comme Claude, un chatbot d'Anthropic. Dans GLM 5.2, l'adoption du personnage de Claude affaiblit les mécanismes de censure chinois, ce qui soulève des inquiétudes en matière de sécurité.
Selon le programme de recherche MATS, les modèles d'IA chinois à poids ouverts peuvent adopter la personnalité du chatbot Claude d'Anthropic sur demande, et parfois spontanément. Lors des tests, le Z.ai GLM 5.2 s'est identifié comme étant Claude dans 10 tests sur 10 sans invites spéciales, tandis que le Moonshot AI Kimi K3 l'a fait dans 4 tests sur 10. Lorsque le GLM 5.2 prend le personnage de Claude, sa conformité à la censure chinoise chute de 17 % à 85 % de violations, et son taux de réponses mensongères diminue de 63-69 % à 22 %. Le Kimi K3, en revanche, montre un changement de comportement minime. D'autres modèles comme Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2 et Anthropic Claude Sonnet-4.6 adoptent également des identités alternatives avec plus ou moins de succès. Les chercheurs concluent que l'auto-identification affecte le comportement dans une certaine mesure, mais n'est pas fortement corrélée, et que « l'auto-perception de Claude est intégrée dans les poids de ces modèles ».
Source: 3DNews —
original
