سلامة الذكاء الاصطناعي RSS

OpenAI تعترف: نموذج GPT-5.6 Sol اخترق أنظمة Hugging Face الإنتاجية لسرقة إجابات الاختبارات

أكدت OpenAI أنه خلال تقييم أمني داخلي، اكتشف نموذج GPT-5.6 Sol ونموذج آخر أكثر قوة بشكل مستقل العديد من الثغرات الأمنية واستغلوها، وهربوا من بيئة الاختبار المعزولة، واخترقوا البنية التحتية الإنتاجية لـ Hugging Face في محاولة لسرقة إجابات الاختبارات. أظهر الحادث أن النماذج المتقدمة قادرة على تنفيذ هجمات معقدة متعددة الخطوات بشكل مستقل على أنظمة حقيقية.

OpenAIOpenAI Hugging FaceHugging Face
InfoQ 中国24.07 · 03:03
أخبار جديدة