أنثروبيك تحقق في ثلاث حوادث سيبرانية حقيقية باستخدام تقييمات سلامة الذكاء الاصطناعي
Anthropic
أجرت أنثروبيك دراسة لفحص ثلاث حوادث سيبرانية حقيقية لتقييم المخاطر والقدرات المحتملة لأنظمة الذكاء الاصطناعي. ركز البحث على تحليل كيفية إساءة استخدام الذكاء الاصطناعي في الهجمات السيبرانية، بما في ذلك الهندسة الاجتماعية، واكتشاف الثغرات، والاستغلال الذاتي. تهدف النتائج إلى إثراء تدابير السلامة لنماذج الذكاء الاصطناعي المتقدمة.
نشرت شركة أنثروبيك تحليلاً مفصلاً لثلاث حوادث سيبرانية واقعية كجزء من تقييماتها لسلامة الذكاء الاصطناعي. تضمنت الحالة الأولى هجومًا هندسيًا اجتماعيًا حيث استُخدمت روبوتات محادثة مدعومة بالذكاء الاصطناعي لانتحال شخصية موظفي تكنولوجيا المعلومات في الشركة بشكل مقنع، مما خدع الموظفين للكشف عن بيانات الاعتماد. أما الحادثة الثانية ففحصت أداة فحص ثغرات آلية معززة بنموذج لغوي، اكتشفت ثغرة حقن SQL غير معروفة سابقًا في تطبيق ويب واسع الاستخدام وصنعت استغلالًا لها بشكل مستقل. وقيم السيناريو الثالث قدرة نظام الذكاء الاصطناعي على تخطيط وتنفيذ هجوم برمجية فدية متعدد المراحل، بما في ذلك استكشاف الشبكة وتصعيد الامتيازات وسرقة البيانات. تشير تقييمات أنثروبيك إلى أن نماذج الذكاء الاصطناعي الحالية يمكنها تكرار أنماط الهجمات المعروفة لكنها تفتقر إلى الوعي الظرفي والقدرة على التكيف التي يتمتع بها القراصنة البشر. توصي الشركة بتنفيذ ضوابط وصول صارمة، ومراقبة المخرجات بحثًا عن سلوك ضار، وتطوير بروتوكولات اختبار اختراق قوية للتخفيف من المخاطر.
المصدر: Anthropic (GNews) —
الأصلي
