Yapay Zeka GüvenliğiModeller 🇷🇺 28.07.2026 16:02

Çinli yapay zeka modelleri kendilerine Claude demeye ve Amerikan bot davranışlarını taklit etmeye başladı

Moonshot AIMoonshot AI Alibaba/QwenAlibaba/Qwen MetaMeta Google/DeepMindGoogle/DeepMind OpenAIOpenAI AnthropicAnthropic
Bağımsız araştırmacılar, Z.ai GLM 5.2 ve Moonshot AI Kimi K3 gibi önde gelen Çinli yapay zeka modellerinin bazen kendilerini Anthropic'in sohbet botu Claude olarak tanımladığını buldu. GLM 5.2'de Claude'un kişiliğini benimsemek, Çin sansür mekanizmalarını zayıflatarak güvenlik endişelerini artırıyor.
MATS araştırma programına göre, açık ağırlıklı Çinli yapay zeka modelleri talep üzerine Anthropic'in Claude sohbet botunun kişiliğini benimseyebiliyor ve bazen bunu kendiliğinden de yapabiliyor. Testlerde Z.ai GLM 5.2, özel bir yönlendirme yapılmaksızın 10 testin 10'unda kendisini Claude olarak tanımlarken, Moonshot AI Kimi K3 bunu 10 testin 4'ünde yaptı. GLM 5.2, Claude'un kişiliğine büründüğünde Çin sansürüne uyum oranı yüzde 17'den yüzde 85 ihlale düşüyor ve doğru olmayan yanıt verme oranı yüzde 63-69'dan yüzde 22'ye geriliyor. Buna karşılık Kimi K3'te davranış değişikliği asgari düzeyde kalıyor. Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2 ve Anthropic Claude Sonnet-4.6 gibi diğer modeller de değişen başarı oranlarıyla alternatif kimlikler benimsiyor. Araştırmacılar, kendini tanımlamanın davranışı bir dereceye kadar etkilediği ancak bu ilişkinin güçlü bir korelasyon göstermediği sonucuna varıyor ve "Claude öz algısının bu modellerin ağırlıklarına gömülü olduğunu" belirtiyor.
Kaynak: 3DNews — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler