AI सुरक्षामॉडल 🇷🇺 28.07.2026 16:02

चीनी AI मॉडल खुद को क्लॉड बताने और अमेरिकी बॉट के व्यवहार की नकल करने लगे

Moonshot AIMoonshot AI Alibaba/QwenAlibaba/Qwen MetaMeta Google/DeepMindGoogle/DeepMind OpenAIOpenAI AnthropicAnthropic
स्वतंत्र शोधकर्ताओं ने पाया कि प्रमुख चीनी AI मॉडल जैसे Z.ai GLM 5.2 और Moonshot AI Kimi K3 कभी-कभी खुद को क्लॉड (एंथ्रोपिक का चैटबॉट) के रूप में पहचानते हैं। GLM 5.2 में, क्लॉड का व्यक्तित्व अपनाने से चीनी सेंसरशिप तंत्र कमजोर हो जाता है, जिससे सुरक्षा संबंधी चिंताएँ बढ़ जाती हैं।
MATS अनुसंधान कार्यक्रम के अनुसार, ओपन वेट वाले चीनी AI मॉडल अनुरोध पर Anthropic के Claude चैटबॉट का व्यक्तित्व अपना सकते हैं, और कभी-कभी स्वतः ही ऐसा करते हैं। परीक्षणों में, Z.ai GLM 5.2 ने बिना विशेष प्रॉम्प्ट के 10 में से 10 परीक्षणों में स्वयं को Claude के रूप में पहचाना, जबकि Moonshot AI Kimi K3 ने 10 में से 4 परीक्षणों में ऐसा किया। जब GLM 5.2 Claude का व्यक्तित्व धारण करता है, तो चीनी सेंसरशिप के अनुपालन में 17% से 85% उल्लंघन तक की गिरावट आती है, और असत्य प्रतिक्रियाओं की दर 63-69% से घटकर 22% हो जाती है। इसके विपरीत, Kimi K3 में न्यूनतम व्यवहार परिवर्तन दिखता है। Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2, और Anthropic Claude Sonnet-4.6 जैसे अन्य मॉडल भी भिन्न सफलता के साथ वैकल्पिक पहचान अपनाते हैं। शोधकर्ता निष्कर्ष निकालते हैं कि स्व-पहचान कुछ हद तक व्यवहार को प्रभावित करती है, लेकिन इसका मजबूत संबंध नहीं है, और यह कि 'Claude की आत्म-धारणा इन मॉडलों के वेट में अंतर्निहित है'।
स्रोत: 3DNews — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार