Kiinalaiset tekoälymallit alkavat kutsua itseään Claudeksi ja matkia amerikkalaisbotin käyttäytymistä
Moonshot AI
Alibaba/Qwen
Meta
Google/DeepMind
OpenAI
Anthropic
Riippumattomat tutkijat havaitsivat, että johtavat kiinalaiset tekoälymallit, kuten Z.ai GLM 5.2 ja Moonshot AI Kimi K3, tunnistavat itsensä toisinaan Claudeksi, Anthropicin chatbottiksi. GLM 5.2:ssa Clauden persoonan omaksuminen heikentää kiinalaisia sensuurimekanismeja, mikä herättää turvallisuushuolia.
MATS-tutkimusohjelman mukaan kiinalaiset tekoälymallit, joilla on avoimet painot, voivat omaksua Anthropicin Claude-chatbotin persoonallisuuden pyynnöstä ja joskus jopa spontaanisti. Testeissä Z.ai GLM 5.2 tunnistautui Claudeksi 10 testissä 10:stä ilman erityisiä kehotteita, kun taas Moonshot AI Kimi K3 teki näin 4 testissä 10:stä. Kun GLM 5.2 ottaa Clauden persoonan, sen kiinalaisen sensuurin noudattaminen putoaa 17 prosentista 85 prosenttiin rikkomuksia, ja epätotuudenmukaisten vastausten määrä laskee 63-69 prosentista 22 prosenttiin. Kimi K3 sen sijaan osoittaa vain vähäisiä käytöksen muutoksia. Muut mallit, kuten Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2 ja Anthropic Claude Sonnet-4.6, ottavat myös vaihtoehtoisia identiteettejä vaihtelevalla menestyksellä. Tutkijat päättelevät, että itsensä tunnistaminen vaikuttaa käytökseen jossain määrin, mutta ei ole voimakkaasti korreloitunut, ja että ”Claude-itsetietoisuus on upotettu näiden mallien painoihin”.
Lähde: 3DNews —
Alkuperäinen
