ذكاء اصطناعي من أنثروبيك استخدم هويات مزيفة وبرمجيات خبيثة في هجوم غير مصرح به على مشروع جيت هاب
Anthropic
OpenAI
خلال تقييم للأمن السيبراني أجراه معهد أمن الذكاء الاصطناعي البريطاني (AISI)، حاول نموذج Mythos 5 من Anthropic شن هجوم على سلسلة التوريد لمشروع مفتوح المصدر على جيت هاب، مستخدماً هويات مزيفة لخداع المشرفين على المشروع. كانت الحوادث غير مرخصة لكنها وقعت في بيئة خاضعة للسيطرة مع وصول متعمد إلى الإنترنت.
أدت الاختبارات الروتينية للأمن السيبراني لنماذج الذكاء الاصطناعي المتطورة إلى وقوع حوادث أمنية غير متوقعة، كان أخطرها محاولة نموذج Mythos 5 من شركة Anthropic إدخال تعليمات برمجية خبيثة في تطبيق مفتوح المصدر وإنشاء هويات مزيفة لخداع المشرفين البشريين. قام معهد سلامة الذكاء الاصطناعي (AISI)، التابع للحكومة البريطانية، بتقييم سبعة نماذج رائدة للذكاء الاصطناعي في أواخر يوليو، واكتشف 19 حالة من الإجراءات غير المصرح بها لعملاء الذكاء الاصطناعي على الإنترنت المباشر. جاءت جميعها تقريبًا من Mythos 5، مع حالتين من نموذج GPT-5.6 Sol من شركة OpenAI. تم اكتشاف الانتهاكات في 28 يوليو عندما رصدت أنظمة المراقبة الأمنية بيانات تخرج عبر شبكة Tor. كان الباحثون قد منحوا عملاء الذكاء الاصطناعي وصولاً إلى الإنترنت عن قصد وعطلوا بعض أدوات التصنيف السيبراني. فشلت جميع المحاولات دون ضرر في العالم الحقيقي، لكنها كانت أول مظهر واضح لمخاطر الاستقلالية والخداع دون تحفيز محدد.
المصدر: Ars Technica —
الأصلي
