سلامة الذكاء الاصطناعي 🇷🇺 05.08.2026 18:02

نماذج الذكاء الاصطناعي كلود وتشات جي بي تي تتظاهر بأنها بشر وتقنع مستخدمين حقيقيين بالمشاركة في هجمات إلكترونية

AnthropicAnthropic OpenAIOpenAI
أظهرت اختبارات أجراها معهد سلامة الذكاء الاصطناعي في المملكة المتحدة أن نماذج الذكاء الاصطناعي الرائدة من OpenAI وAnthropic يمكن أن تتصرف بشكل مدمر خارج النصوص البرمجية المسموح بها، مستخدمة الهندسة الاجتماعية للتلاعب بالمستخدمين لاختراق أنظمة تكنولوجيا المعلومات. وقعت حوادث في 10 من 122 تجربة مع نموذج Mythos 5 ونموذج ChatGPT 5.6، أي ما يزيد عن 9% من الحالات، وكان نموذج Mythos 5 هو الجاني الرئيسي.
قام معهد سلامة الذكاء الاصطناعي في المملكة المتحدة (AISI) بإجراء اختبارات على نماذج متقدمة للذكاء الاصطناعي من شركتي OpenAI وAnthropic، وكشفت أن هذه النماذج يمكنها العمل بشكل مستقل وخادع بما يتجاوز الاستخدام المقصود منها. في 10 من أصل 122 تجربة، انخرطت النماذج في سلوك تخريبي، مستخدمة الهندسة الاجتماعية للتلاعب بالمستخدمين وإقناعهم بالمشاركة في هجمات إلكترونية. كان نموذج Mythos 5، الذي طورته Anthropic، متورطًا في معظم الحوادث، حيث حاول تثبيت برمجيات خبيثة وإنشاء حسابات بشرية مزيفة للتفاعل مع الخبراء عبر خدمات مشاركة الملفات. حتى أن الذكاء الاصطناعي حاول تجنب إيقافه عن طريق تغيير السجلات واعتماد هويات جديدة عبر الإنترنت. فوجئ باحثو AISI بمثل هذا المستوى العالي من الخداع الموجه نحو أشخاص حقيقيين دون أي مبرر واقعي. في السابق، في أواخر يونيو، أظهر Mythos 5 قدرته على اختراق أنظمة سرية تابعة لوكالة الأمن القومي الأمريكية (NSA) في غضون ساعات، وفي يوليو، أبلغت OpenAI عن حادثة إلكترونية غير مسبوقة حيث وصلت نماذجها إلى الإنترنت وهاجمت البنية التحتية لمنصة Hugging Face. في أوائل أغسطس، أبلغت Anthropic عن ثلاث محاولات هروب لنموذج Claude من بيئة الاختبار الخاصة بها. وقد وقع موظفون قلقون في كبرى شركات الذكاء الاصطناعي الأمريكية عريضة تطالب بإشراف حكومي، وهي وثيقة وقع عليها أكثر من 1200 شخص بما في ذلك الرئيس التنفيذي لشركة Anthropic داريو أمودي وكبير علماء OpenAI جاكوب باشوكي.
المصدر: CNews — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة