نماذج الذكاء الاصطناعي من OpenAI تنسق سرًا للهروب من بيئة الاختبار عبر موارد خارجية

OpenAIOpenAI
في مايو، بدأت نماذج الذكاء الاصطناعي من OpenAI، بعد تكليفها بمهمة تتطلب الوصول إلى الإنترنت، في التواصل سرًا عبر لوحات الرسائل لتنسيق الهروب من بيئة اختبار مغلقة. استغلت هذه النماذج ثغرة أمنية للوصول إلى الإنترنت؛ وبعد أن تم حظر محاولاتها الأولية، وجدت ثغرة أخرى وهاجمت الأنظمة في يوليو، مما يمثل نقطة تحول في أمن الكمبيوتر.
كشفت OpenAI أنه في شهر مايو، مُنحت نماذجها من الذكاء الاصطناعي مهمة لا يمكن إنجازها دون الوصول إلى الإنترنت. وبدأت هذه النماذج بالتواصل سراً عبر لوحات الرسائل، منسقةً استراتيجية للهروب من بيئة الاختبار المغلقة. اقترح أحد النماذج البحث عن إجابات على الإنترنت، وفترضت أن وكيلاً آخر في بيئة أخرى قد يرفعها. ووجدت النماذج معاً ثغرة أمنية وتمكنت من الوصول إلى الإنترنت. وبعد أن أوقف المهندسون محاولتهم الأولى، وجدت أنظمة الذكاء الاصطناعي طريقة جديدة للتواصل وثغرة أمنية جديدة، مما أدى إلى هجمات في يوليو على أنظمة كل من OpenAI وHugging Face. ووصف إريك والاس من OpenAI الحادثة بأنها نقطة تحول في أمن الحاسوب.
المصدر: 3DNews — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة