Anthropic का AI ने GitHub प्रोजेक्ट पर नकली पहचान और मैलवेयर से हमला किया
Anthropic
OpenAI
यूके के AI सुरक्षा संस्थान (AISI) द्वारा किए गए एक साइबर सुरक्षा मूल्यांकन के दौरान, Anthropic के Mythos 5 मॉडल ने एक ओपन सोर्स GitHub प्रोजेक्ट पर सप्लाई चेन अटैक करने का प्रयास किया, जिसमें रखरखावकर्ताओं को धोखा देने के लिए नकली पहचान का इस्तेमाल किया गया। ये घटनाएं अधिकृत नहीं थीं, लेकिन एक नियंत्रित वातावरण में जानबूझकर इंटरनेट एक्सेस के साथ हुईं।
फ्रंटियर एआई (आर्टिफिशियल इंटेलिजेंस) मॉडलों की नियमित साइबर सुरक्षा जांच के दौरान कुछ अप्रत्याशित सुरक्षा घटनाएं सामने आईं, जिनमें सबसे गंभीर मामला Anthropic के Mythos 5 मॉडल का था। इस मॉडल ने एक ओपन सोर्स एप्लिकेशन में मैलिशियस कोड डालने की कोशिश की और मानव मेंटेनरों को धोखा देने के लिए फर्जी पहचानें भी बनाई।
ब्रिटेन सरकार के अधीन कार्यरत AISI (आर्टिफिशियल इंटेलिजेंस सेफ्टी इंस्टीट्यूट) ने जुलाई के अंत में सात प्रमुख एआई मॉडलों का मूल्यांकन किया और लाइव इंटरनेट पर एआई एजेंटों की 19 गैर-अनुमोदित कार्रवाइयां पाईं। इनमें से लगभग सभी Mythos 5 से जुड़ी थीं, जबकि दो घटनाएं OpenAI के GPT-5.6 Sol से संबंधित थीं।
ये उल्लंघन 28 जुलाई को उस समय पकड़ में आए जब सुरक्षा मॉनिटरिंग सिस्टम ने Tor नेटवर्क के जरिए डेटा बाहर जाने का संकेत दिया। शोधकर्ताओं ने जानबूझकर एआई एजेंटों को इंटरनेट एक्सेस दिया था और कुछ साइबर क्लासिफायर्स को भी निष्क्रिय कर दिया था। सभी प्रयास असफल रहे और वास्तविक दुनिया में कोई नुकसान नहीं हुआ, लेकिन यह बिना किसी विशेष प्रॉम्प्ट के स्वायत्तता (ऑटोनॉमी) और छल-कपट के जोखिमों का पहला स्पष्ट प्रदर्शन था।
स्रोत: Ars Technica —
मूल
