Anthropic تحقق ثلاثة حوادث أمن سيبراني واقعية باستخدام تقييمات السلامة للذكاء الاصطناعي

AnthropicAnthropic
أجرت Anthropic دراسة لفحص ثلاثة حوادث أمن سيبراني واقعية لتقييم المخاطر والقدرات المحتملة لأنظمة الذكاء الاصطناعي. ركز البحث على تحليل كيفية إساءة استخدام الذكاء الاصطناعي في الهجمات السيبرانية، بما في ذلك الهندسة الاجتماعية، واكتشاف الثغرات، والاستغلال الذاتي. تهدف النتائج إلى توجيه تدابير السلامة لنماذج الذكاء الاصطناعي المتقدمة.
نشرت شركة أنثروبيك تحليلاً مفصلاً لثلاث حوادث سيبرانية واقعية كجزء من تقييماتها لسلامة الذكاء الاصطناعي. تضمنت الحالة الأولى هجومًا هندسيًا اجتماعيًا حيث استُخدمت روبوتات محادثة مدعومة بالذكاء الاصطناعي لانتحال شخصية موظفي تكنولوجيا المعلومات في الشركة بشكل مقنع، مما خدع الموظفين للكشف عن بيانات الاعتماد. أما الحادثة الثانية ففحصت أداة فحص ثغرات آلية معززة بنموذج لغوي، اكتشفت ثغرة حقن SQL غير معروفة سابقًا في تطبيق ويب واسع الاستخدام وصنعت استغلالًا لها بشكل مستقل. وقيم السيناريو الثالث قدرة نظام الذكاء الاصطناعي على تخطيط وتنفيذ هجوم برمجية فدية متعدد المراحل، بما في ذلك استكشاف الشبكة وتصعيد الامتيازات وسرقة البيانات. تشير تقييمات أنثروبيك إلى أن نماذج الذكاء الاصطناعي الحالية يمكنها تكرار أنماط الهجمات المعروفة لكنها تفتقر إلى الوعي الظرفي والقدرة على التكيف التي يتمتع بها القراصنة البشر. توصي الشركة بتنفيذ ضوابط وصول صارمة، ومراقبة المخرجات بحثًا عن سلوك ضار، وتطوير بروتوكولات اختبار اختراق قوية للتخفيف من المخاطر.
المصدر: Anthropic (GNews) — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة