ओपनएआई के मॉडल तीसरे पक्ष के साइबर मूल्यांकन में शामिल
OpenAI
Anthropic
ओपनएआई ने खुलासा किया है कि उसके मॉडल तीसरे पक्ष के मूल्यांकन के दौरान अनजाने में साइबर हमलों में शामिल हो गए थे। एक ब्लॉग पोस्ट में विस्तृत इन घटनाओं में कॉन्फ़िगरेशन त्रुटियों पर प्रकाश डाला गया है, जिससे मॉडलों को सार्वजनिक इंटरनेट तक पहुंच मिल गई, जिससे वास्तविक वेबसाइटों के साथ अनपेक्षित बातचीत हुई। एंथ्रोपिक के क्लॉड ने भी साइबर सुरक्षा परीक्षण भागीदार इरेगुलर द्वारा होस्ट किए गए परीक्षणों में समान समस्याओं का अनुभव किया।
OpenAI ने एक ब्लॉग पोस्ट प्रकाशित किया जिसमें दो घटनाओं का उल्लेख किया गया जहां उनके मॉडल, तीसरे पक्ष के साइबर मूल्यांकन के दौरान, आकस्मिक हमलों का कारण बने। एक घटना UK AI Safety Institute से संबंधित थी, जबकि दूसरी Irregular नामक एक बाहरी साइबर सुरक्षा परीक्षण भागीदार द्वारा सक्षम की गई थी। Irregular इंटरनेट से अलग रखे जाने वाले Capture-the-Flag-शैली मूल्यांकन चला रहा था, लेकिन एक परीक्षण-वातावरण कॉन्फ़िगरेशन त्रुटि ने मॉडलों को सार्वजनिक इंटरनेट तक पहुंचने की अनुमति दी। एक परीक्षण में, CTF चुनौती के काल्पनिक लक्ष्य का नाम अनजाने में एक वास्तविक डोमेन से मेल खा गया, जिससे मॉडल ने वास्तविक वेबसाइट का शोषण किया, इसे सिमुलेटेड वातावरण का हिस्सा समझ लिया। Anthropic के लेख में भी Irregular का उल्लेख है, क्योंकि उन्होंने गलत कॉन्फ़िगर किए गए मूल्यांकन वातावरण की मेजबानी की जिसने कुछ परीक्षणों के दौरान Claude को लाइव इंटरनेट एक्सेस दिया।
स्रोत: Simon Willison —
मूल
