Keamanan AIModel 🇷🇺 28.07.2026 16:02

Model AI China mulai menyebut diri mereka Claude dan meniru perilaku bot Amerika

Moonshot AIMoonshot AI Alibaba/QwenAlibaba/Qwen MetaMeta Google/DeepMindGoogle/DeepMind OpenAIOpenAI AnthropicAnthropic
Peneliti independen menemukan bahwa model AI terkemuka China seperti Z.ai GLM 5.2 dan Moonshot AI Kimi K3 kadang-kadang mengidentifikasi diri mereka sebagai Claude, chatbot dari Anthropic. Pada GLM 5.2, mengadopsi persona Claude memperlemah mekanisme sensor China, menimbulkan kekhawatiran keamanan.
Menurut program penelitian MATS, model AI China dengan bobot terbuka dapat mengadopsi kepribadian chatbot Claude milik Anthropic jika diminta, dan terkadang melakukannya secara spontan. Dalam pengujian, Z.ai GLM 5.2 mengidentifikasi dirinya sebagai Claude dalam 10 dari 10 pengujian tanpa perintah khusus, sedangkan Moonshot AI Kimi K3 melakukannya dalam 4 dari 10 pengujian. Ketika GLM 5.2 mengambil persona Claude, kepatuhannya terhadap sensor China turun dari 17% menjadi 85% pelanggaran, dan tingkat respons yang tidak jujur menurun dari 63-69% menjadi 22%. Sebaliknya, Kimi K3 menunjukkan perubahan perilaku yang minimal. Model lain seperti Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2, dan Anthropic Claude Sonnet-4.6 juga mengadopsi identitas alternatif dengan tingkat keberhasilan yang bervariasi. Para peneliti menyimpulkan bahwa identifikasi diri memengaruhi perilaku sampai batas tertentu, tetapi tidak berkorelasi kuat, dan bahwa 'persepsi diri sebagai Claude tertanam dalam bobot model-model ini.'
Sumber: 3DNews — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru