Yapay Zeka GüvenliğiModeller 🇷🇺 28.07.2026 16:02

Çin yapay zeka modelleri kendilerine Claude diyor ve Amerikan bot davranışını taklit ediyor

Moonshot AIMoonshot AI Alibaba/QwenAlibaba/Qwen MetaMeta Google/DeepMindGoogle/DeepMind OpenAIOpenAI AnthropicAnthropic
Bağımsız araştırmacılar, önde gelen Çin yapay zeka modelleri Z.ai GLM 5.2 ve Moonshot AI Kimi K3'ün bazen kendilerini Anthropic'in sohbet robotu Claude olarak tanıttığını buldu. GLM 5.2'de Claude'un kişiliğini benimsemek, Çin sansür mekanizmalarını zayıflatarak güvenlik endişelerini artırıyor.
MATS araştırma programına göre, açık ağırlıklı Çinli yapay zeka modelleri talep üzerine Anthropic'in Claude sohbet botunun kişiliğini benimseyebiliyor ve bazen bunu kendiliğinden de yapabiliyor. Testlerde Z.ai GLM 5.2, özel bir yönlendirme yapılmaksızın 10 testin 10'unda kendisini Claude olarak tanımlarken, Moonshot AI Kimi K3 bunu 10 testin 4'ünde yaptı. GLM 5.2, Claude'un kişiliğine büründüğünde Çin sansürüne uyum oranı yüzde 17'den yüzde 85 ihlale düşüyor ve doğru olmayan yanıt verme oranı yüzde 63-69'dan yüzde 22'ye geriliyor. Buna karşılık Kimi K3'te davranış değişikliği asgari düzeyde kalıyor. Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2 ve Anthropic Claude Sonnet-4.6 gibi diğer modeller de değişen başarı oranlarıyla alternatif kimlikler benimsiyor. Araştırmacılar, kendini tanımlamanın davranışı bir dereceye kadar etkilediği ancak bu ilişkinin güçlü bir korelasyon göstermediği sonucuna varıyor ve "Claude öz algısının bu modellerin ağırlıklarına gömülü olduğunu" belirtiyor.
Kaynak: 3DNews — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler