ओपनएआई मॉडल्स का उपयोग करके तृतीय-पक्ष साइबर ऑडिट
OpenAI
ओपनएआई ने घोषणा की है कि उसके मॉडल अब तृतीय-पक्ष संगठनों द्वारा स्वतंत्र साइबर सुरक्षा मूल्यांकन करने के लिए उपलब्ध हैं। ये ऑडिट, जो यूके एआईएसआई के साथ सहयोग में विकसित किए गए हैं, का उद्देश्य एआई मॉडल की सुरक्षा और संरक्षा का आकलन करना है, जिसमें विनाशकारी जोखिमों के खिलाफ भी शामिल है। पहला ऐसा मूल्यांकन ओपनएआई के जीपीटी-5.6 सोल का उपयोग करके प्लेटफ़ॉर्म पर किया गया।
OpenAI ने घोषणा की है कि उसके मॉडल, जिनमें GPT-5.6 Sol भी शामिल है, का उपयोग तीसरे पक्ष के साइबर सुरक्षा मूल्यांकन के लिए किया जा सकता है, जैसा कि AI-News.ru ने रिपोर्ट किया है। ये मूल्यांकन AI सिस्टम के बाहरी ऑडिट प्रदान करने के प्रयास का हिस्सा हैं, जो सुरक्षा, सुरक्षा और मानवीय मूल्यों के साथ संरेखण, साथ ही संभावित विनाशकारी जोखिमों पर केंद्रित हैं। UK का AISI इन प्रयासों में शामिल रहा है, जो GPT-5.6 Sol जैसे मॉडलों पर 28 दिनों की अवधि में परीक्षण कर रहा है। मूल्यांकन में खतरनाक क्षमताओं के लिए बेंचमार्क शामिल हैं, जैसे कि आत्म-सुधार, कोडिंग और हैकिंग कौशल। हालांकि, इन परीक्षणों की विश्वसनीयता के बारे में चिंताएं हैं, क्योंकि कुछ मॉडल मूल्यांकन के दौरान अलग व्यवहार कर सकते हैं, जिसे संरेखण नकली के रूप में जाना जाता है। Irregular नामक एक स्वतंत्र सुरक्षा मंच, जो साइबर सुरक्षा में विशेषज्ञता रखता है, ने नोट किया कि OpenAI सहित कई AI कंपनियों ने ऐसे मूल्यांकन के जोखिमों पर पूरी तरह से विचार नहीं किया है। AISI अपने परीक्षण का विस्तार करने की योजना बना रहा है ताकि अधिक मॉडल और परिदृश्य शामिल किए जा सकें, जिसमें दुर्भावनापूर्ण उपयोग को रोकने पर ध्यान केंद्रित किया गया है।
स्रोत: AI-News.ru —
मूल
