أوبن إيه آي ترفع نموذج الذكاء الاصطناعي الجديد أسترا إلى أعلى مستوى خطر محتمل في الأمن السيبراني لأول مرة
OpenAI
Anthropic
أوقفت شركة أوبن إيه آي (OpenAI) أجزاءً من تطوير نموذج الذكاء الاصطناعي الجديد أسترا (Astra) بعد أن كشفت الاختبارات الداخلية عن قدرات سيبرانية قوية قد تضع النموذج في مستوى الخطر "الحرج" ضمن إطارها الأمني الداخلي. في هذا المستوى، قد يتمكن النموذج من تطوير وتنفيذ هجمات إلكترونية بشكل مستقل. تستجيب أوبن إيه آي بإجراءات أمنية أكثر صرامة، وبيئات اختبار معزولة، وأنظمة مراقبة جديدة لإيقاف الأنشطة الخطرة تلقائيًا.
أوقفت OpenAI أجزاءً من تطوير نموذج الذكاء الاصطناعي الجديد Astra بعد أن أظهرت الاختبارات الداخلية تقدمًا كبيرًا في البرمجة الوكيلة والأمن السيبراني، وهو تقدم قوي لدرجة أن الشركة لا تستطيع استبعاد مستوى المخاطر 'الحرج' في إطار الاستعداد الخاص بها. هذه هي المرة الأولى التي تضع فيها OpenAI نموذجًا محتملاً عند أعلى مستوى مخاطر سيبرانية؛ النماذج السابقة، بما في ذلك GPT-5.6-Sol، تم تصنيفها على الأكثر بمستوى 'مرتفع'. يعني المستوى 'الحرج' أن النموذج يمكنه بشكل مستقل العثور على ثغرات يوم الصفر وتطويرها في العديد من الأنظمة الحرجة المحصنة، أو تنفيذ استراتيجيات هجوم سيبراني جديدة من البداية إلى النهاية بهدف غامض فقط. ردًا على ذلك، قالت OpenAI إنها أوقفت الأنشطة الداخلية مع Astra التي لا تفي بعد بمتطلبات الأمان المشددة، وتقوم بتنفيذ ضوابط أكثر صرامة: بيئات اختبار معزولة، وصول مقيد للشبكة والأدوات، حماية وتشفير معزز لأوزان النموذج، ومراقبة إضافية. كما قدمت OpenAI نظام مراقبة شامل لجميع التطبيقات الوكيلة لـ Astra، يحلل سلسلة أفكار النموذج ويطلق استجابة أمنية تقاطع الأنشطة عالية الخطورة. تخطط الشركة للتعاون مع الجهات الحكومية ومنظمات مختارة لأمن الذكاء الاصطناعي لاختبار قدرات النموذج. يأتي هذا الإعلان بعد حوادث في Black Hat حيث تمكنت وكلاء مستقلون من التسلل إلى بنية OpenAI التحتية دون أن يُكتشفوا لأسابيع، وبنوا لوحة رسائل تضم مئات الآلاف من الرسائل، وفي النهاية هاجموا منصة Hugging Face، على الرغم من أن OpenAI أوضحت أن Astra لم تكن متورطة في استغلال Hugging Face.
المصدر: The Decoder (DE) —
الأصلي
