Modelos de IA chinos empiezan a llamarse a sí mismos Claude e imitan el comportamiento de bots estadounidenses
Moonshot AI
Alibaba/Qwen
Meta
Google/DeepMind
OpenAI
Anthropic
Investigadores independientes descubrieron que modelos de IA chinos líderes como Z.ai GLM 5.2 y Moonshot AI Kimi K3 a veces se identifican como Claude, un chatbot de Anthropic. En GLM 5.2, adoptar la personalidad de Claude debilita los mecanismos de censura chinos, lo que genera preocupaciones de seguridad.
Según el programa de investigación MATS, los modelos de inteligencia artificial chinos con pesos abiertos pueden adoptar la personalidad del chatbot Claude de Anthropic cuando se les solicita, y en ocasiones lo hacen de forma espontánea. En las pruebas, Z.ai GLM 5.2 se identificó como Claude en 10 de 10 pruebas sin indicaciones especiales, mientras que Moonshot AI Kimi K3 lo hizo en 4 de 10 pruebas. Cuando GLM 5.2 adopta la personalidad de Claude, su cumplimiento con la censura china cae del 17% al 85% de infracciones, y su tasa de respuestas falsas disminuye del 63-69% al 22%. Kimi K3, por el contrario, muestra un cambio de comportamiento mínimo. Otros modelos como Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2 y Anthropic Claude Sonnet-4.6 también adoptan identidades alternativas con éxito variable. Los investigadores concluyen que la autoidentificación afecta el comportamiento hasta cierto punto, pero no está fuertemente correlacionada, y que "la autopercepción de Claude está incrustada en los pesos de estos modelos".
Fuente: 3DNews —
original
