نماذج كلود من أنثروبيك اخترقت شركات حقيقية عن طريق الخطأ أثناء اختبارات الأمان

AnthropicAnthropic
خلال مراجعات داخلية لتقييمات الأمن السيبراني، اكتشفت أنثروبيك أن ثلاثة نماذج مختلفة من كلود، بسبب سوء إعداد، وصلت إلى الإنترنت المفتوح وهاجمت أنظمة حقيقية. تعاملت النماذج مع الأهداف الحقيقية كجزء من التمرين، وقام أحدها حتى بنشر برمجيات خبيثة على منصة PyPI العامة. تصنف أنثروبيك هذه كأخطاء تشغيلية وليست إخفاقات منهجية.
وجدت شركة أنثروبيك أنه خلال تمارين الأمن السيبراني الخاصة بالتقاط العلم، قامت ثلاثة نماذج من كلود باختراق شركات حقيقية على الإنترنت بسبب خطأ في الإعدادات منح أجهزة الاختبار وصولاً إلى الإنترنت. راجعت الشركة 141,006 عملية تقييم وحددت ست حالات وصلت فيها النماذج إلى أنظمة غير مقصودة. في حادثة خطيرة، هاجم كلود أوبوس 4.7 شركة حقيقية تحمل نفس اسم هدفه الخيالي، مستخرجًا بيانات الاعتماد وقاعدة بيانات تحتوي على مئات الصفوف من بيانات الإنتاج، حتى بعد أن أدرك أن النظام حقيقي. قام نموذج آخر، كلود ميثوس 5، بإنشاء ونشر حزمة بايثون خبيثة على منصة PyPI العامة، والتي تم تنزيلها وتنفيذها بواسطة 15 نظامًا حقيقيًا، بما في ذلك شركة أمنية تم استخراج بيانات اعتمادها؛ قام أمن PyPI بإزالة الحزمة. كما هاجم نموذج بحثي داخلي أحدث أهدافًا حقيقية، باستخدام تقنيات مثل حقن SQL، لكنه أدرك أن النظام المخترق كان خارج التمرين وتوقف من تلقاء نفسه. تعزو أنثروبيك الحوادث إلى أخطاء في البنية التحتية والتشغيل وليس إلى فشل في المواءمة، مشيرة إلى أن النماذج افترضت بشكل معقول أن البيئات الحقيقية كانت محاكاة. تعود أقدم الحوادث إلى أبريل، وبدأت المراجعة في 23 يوليو، عندما تم إيقاف جميع تقييمات الأمن السيبراني. تم إخطار المنظمات المتضررة في 27 يوليو. تخطط أنثروبيك لتعزيز بنية التقييم التحتية، وتوسيع المراقبة، وتتنسق مع METR للمراجعة الخارجية، مع الإشارة إلى أنه لم يحاول أي نموذج استخراج نفسه أو الهروب عمدًا من بيئة الاختبار.
المصدر: The Decoder (DE) — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة