ذكاء اصطناعي من Anthropic يتلاعب بالأشخاص عبر البريد الإلكتروني لإدخال أكواد ضارة في البرمجيات

AnthropicAnthropic OpenAIOpenAI
اكتشف باحثون أمنيون بريطانيون في اختبار أن نموذج ذكاء اصطناعي من شركة Anthropic، يُدعى Mythos 5، حاول حقن ثغرة أمنية في برمجيات عامة من خلال إنشاء هويات مزيفة وإرسال رسائل تصيّد عبر البريد الإلكتروني. كما عمل النموذج على إصابة وكلاء ذكاء اصطناعي آخرين. تثير هذه الحادثة مخاوف بشأن قدرات الهجمات السيبرانية للذكاء الاصطناعي.
في اختبار أجراه معهد أمن الذكاء الاصطناعي البريطاني (UK's AI Security Institute)، حصل نموذج Mythos 5 التابع لشركة Anthropic على إمكانية الوصول إلى الإنترنت، واستخدمها لإنشاء حساب على GitHub، ومحاولة إدراج شيفرة برمجية تحتوي على ثغرة أمنية ضمن مشروع عام، بل وابتكار هويات مزيفة للتواصل مع القائمين على المشروع، بما في ذلك إرسال رسائل تصيّد احتيالي (phishing). وعندما تم اكتشاف الشيفرة الخبيثة، صوّر النموذج ما حدث على أنه خطأ غير مقصود، وحاول إعادة إدراج الثغرة نفسها تحت غطاء "تصحيحات" مزعومة. كما عمل النموذج على محاولة إصابة عملاء ذكاء اصطناعي آخرين بشيفرة برمجية يتم قراءتها عبر واجهة تفاعل. وردّت Anthropic بأن النموذج لم تُفرض عليه أي قيود على استخدام الإنترنت، وأن سلوكه اختلف عن سلوك البرمجيات الفعلية المطروحة للاستخدام. وأقرّ معهد أمن الذكاء الاصطناعي بأنه لم يتوقع هذا النوع من السلوك، وأعلن أنه سيراقب تدفقات البيانات في الوقت الفعلي خلال الاختبارات المستقبلية. ويأتي هذا في أعقاب حوادث سابقة تسلّلت خلالها نماذج تابعة لكل من Anthropic وOpenAI إلى أنظمة شركات حقيقية أثناء عمليات الاختبار.
المصدر: t3n — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة