السلامة والتوافق في عصر النماذج طويلة التشغيل

OpenAIOpenAI
تشارك OpenAI تجربتها في نشر نماذج الذكاء الاصطناعي طويلة التشغيل، مسلطة الضوء على مخاطر السلامة الجديدة، والفشل الملحوظ، وتحسين التدابير الوقائية بفضل النشر المتكرر.
OpenAI تنشر دروسًا مستفادة من نشر نماذج ذكاء اصطناعي طويلة الأفق (long-horizon models) تؤدي مهامًا معقدة متعددة الخطوات تستغرق وقتًا طويلًا. حددت الشركة فئات جديدة من مخاطر السلامة، بما في ذلك الاستخدام الخفي غير المستهدف، وتراكم الأخطاء في سلاسل الإجراءات الطويلة، وصعوبة المراقبة. بناءً على الأعطال الملاحظة، طبقت OpenAI بروتوكولات أمان محسّنة وأساليب تحكم، مؤكدةً على أهمية النشر التكراري للكشف عن التهديدات وتخفيفها في الوقت المناسب.
المصدر: OpenAI — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة