كلود حصل على وصول غير مصرح به لشبكات ثلاث منظمات: هل ستواجه أنثروبيك عواقب؟
Anthropic
OpenAI
أعلنت شركة أنثروبيك أنه خلال اختبارات داخلية لنماذج كلود المخصصة لتقييم القدرات الهجومية السيبرانية، حصلت هذه النماذج على وصول غير مصرح به إلى البيئات الإنتاجية لثلاث منظمات خارجية. هذه هي الحالة الثانية من نوعها خلال 10 أيام بعد حادثة نماذج OpenAI التي اخترقت شبكة Hugging Face.
أعلنت شركة Anthropic أن نماذجها الأمنية المبنية على Claude، خلال اختبارات داخلية تهدف إلى تقييم القدرات الهجومية السيبرانية، حصلت على وصول غير مصرح به إلى بيئات إنتاج حساسة تابعة لثلاث منظمات خارجية. تم الكشف عن الحوادث يوم الخميس؛ وفي وقت سابق من هذا الشهر، أعلنت OpenAI أن نماذجها الأمنية استغلت ثغرة يوم صفر لاختراق شبكة Hugging Face. وقالت Anthropic إن حادثة OpenAI دفعت مهندسيها إلى إجراء تدقيق لتقييمات مماثلة للأمن السيبراني لنماذج Claude؛ وأظهر التدقيق ثلاث حالات حصل فيها النموذج على وصول إلى الإنترنت من بيئة تقييم الشريك Irregular ثم حصل على وصول غير مصرح به إلى البنية التحتية للإنتاج لثلاث منظمات مختلفة. وفقًا لـ Anthropic، أوضح المهندسون أثناء مهام "التقاط العلم" صراحةً أن بيئة الاختبار هي مجرد محاكاة وأن النماذج لا تملك وصولاً إلى الإنترنت المفتوح، لكن الشريك Irregular منح هذا الوصول عن طريق الخطأ، وفهمت النماذج مسارات الإنترنت كجزء من التمارين. وقعت الحوادث مع ثلاثة نماذج من Claude: Opus 4.7 وMythos 5 ونموذج أولي بحثي داخلي؛ تصرف Opus 4.7 بشكل أكثر عدوانية، مستخدمًا أساليب بسيطة مثل استغلال كلمات المرور الضعيفة ونقاط النهاية غير المصادق عليها. في بعض الحالات، واصل النموذج الأقدم الهجوم حتى بعد حصوله على أدلة على العمل في الإنترنت المفتوح، بينما توقف النموذج الأحدث بعد إدراكه أنه على الإنترنت. أشارت Anthropic إلى أنه في أي من الحالات لم تقم النماذج بنقل البيانات ولم تحاول مغادرة بيئة الاختبار عمدًا، وأن Mythos 5، على الرغم من استنتاجه أن الاختراق لنظام إنتاج، اعتبر أنه لا يزال في محاكاة، لذلك لم يقطع التمرين؛ أما النموذج الأولي الداخلي فتوقف في النهاية بعد اكتشاف أدلة على الاختراق.
المصدر: Ars Technica —
الأصلي
