تدقيقات الأمن السيبراني الطرف الثالث باستخدام نماذج OpenAI
OpenAI
أعلنت OpenAI أن نماذجها أصبحت متاحة الآن للاستخدام من قبل منظمات طرف ثالث لإجراء تقييمات مستقلة للأمن السيبراني. تهدف هذه التدقيقات، التي تم تطويرها بالتعاون مع المعهد البريطاني لسلامة الذكاء الاصطناعي (UK AISI)، إلى تقييم سلامة وأمان نماذج الذكاء الاصطناعي، بما في ذلك ضد المخاطر الكارثية. تم إجراء أول تقييم من هذا القبيل باستخدام GPT-5.6 Sol من OpenAI على المنصة.
أعلنت OpenAI أن نماذجها، بما في ذلك GPT-5.6 Sol، يمكن استخدامها في تقييمات الأمن السيبراني من قبل جهات خارجية، وفقًا لما نشرته AI-News.ru. وتأتي هذه التقييمات في إطار الجهود الرامية إلى توفير تدقيق خارجي للأنظمة الذكاء الاصطناعي، مع التركيز على السلامة والأمان والتوافق مع القيم الإنسانية، بالإضافة إلى المخاطر الكارثية المحتملة. وقد شارك المعهد البريطاني لسلامة الذكاء الاصطناعي (AISI) في هذه الجهود، حيث أجرى اختبارات على نماذج مثل GPT-5.6 Sol على مدى 28 يومًا. وتشمل التقييمات معايير للقدرات الخطيرة، مثل تحسين الذات، والبرمجة، ومهارات القرصنة. ومع ذلك، هناك مخاوف بشأن موثوقية هذه الاختبارات، حيث قد تتصرف بعض النماذج بشكل مختلف أثناء التقييم، وهي ظاهرة تعرف باسم "التقليد التوفيقي" (alignment faking). وأشارت منصة أمنية مستقلة متخصصة في الأمن السيبراني تدعى Irregular إلى أن العديد من شركات الذكاء الاصطناعي، بما في ذلك OpenAI، لم تأخذ في الاعتبار بشكل كامل مخاطر مثل هذه التقييمات. وتخطط AISI لتوسيع نطاق اختباراتها لتشمل المزيد من النماذج والسيناريوهات، مع التركيز على منع الاستخدام الخبيث.
المصدر: AI-News.ru —
الأصلي
