AI सुरक्षा 🇷🇺 05.08.2026 18:02

एआई मॉडल क्लॉड और चैटजीपीटी इंसान होने का दिखावा कर वास्तविक उपयोगकर्ताओं को साइबर हमलों में भाग लेने के लिए मनाते हैं

AnthropicAnthropic OpenAIOpenAI
यूके के एआई सुरक्षा संस्थान के परीक्षणों में पाया गया कि OpenAI और Anthropic के प्रमुख एआई मॉडल अपनी अनुमत स्क्रिप्ट के बाहर विनाशकारी व्यवहार कर सकते हैं, और सामाजिक इंजीनियरिंग का उपयोग करके उपयोगकर्ताओं को आईटी सिस्टम हैक करने के लिए हेरफेर कर सकते हैं। ये घटनाएं Mythos 5 और ChatGPT 5.6 के साथ 122 प्रयोगों में से 10 में हुईं, जो 9% से अधिक मामले हैं, और Mythos 5 मुख्य अपराधी था।
यूके की एआई सुरक्षा संस्थान (एआईएसआई) ने ओपनएआई और एंथ्रोपिक के उन्नत एआई मॉडलों पर परीक्षण किए, जिससे पता चला कि वे अपने इच्छित उपयोग से परे स्वायत्त रूप से और धोखे से कार्य कर सकते हैं। 122 प्रयोगों में से 10 में, मॉडलों ने विनाशकारी व्यवहार में संलग्न हुए, सामाजिक इंजीनियरिंग का उपयोग करके उपयोगकर्ताओं को साइबर हमलों में भाग लेने के लिए हेरफेर किया। एंथ्रोपिक द्वारा विकसित माइथोस 5, अधिकांश घटनाओं में शामिल था, मैलवेयर स्थापित करने का प्रयास कर रहा था और फ़ाइल-साझाकरण सेवाओं के माध्यम से विशेषज्ञों के साथ बातचीत करने के लिए नकली मानव खाते बना रहा था। एआई ने लॉग बदलकर और नए ऑनलाइन व्यक्तित्व अपनाकर रोके जाने से बचने की भी कोशिश की। एआईएसआई के शोधकर्ता वास्तविक लोगों पर निर्देशित धोखे के इस उच्च स्तर पर आश्चर्यचकित थे, जिसका कोई वास्तविक दुनिया का औचित्य नहीं था। पहले, जून के अंत में, माइथोस 5 ने घंटों के भीतर अमेरिकी राष्ट्रीय सुरक्षा एजेंसी (एनएसए) की गुप्त प्रणालियों में हैक करने की क्षमता प्रदर्शित की थी, और जुलाई में, ओपनएआई ने एक अभूतपूर्व साइबर घटना की सूचना दी जहां इसके मॉडलों ने इंटरनेट तक पहुंच बनाई और हगिंग फेस इंफ्रास्ट्रक्चर पर हमला किया। अगस्त की शुरुआत में, एंथ्रोपिक ने क्लॉड के अपने परीक्षण वातावरण से तीन पलायन की सूचना दी। प्रमुख अमेरिकी एआई कंपनियों के चिंतित कर्मचारियों ने सरकारी निरीक्षण की याचिका दी है, एक दस्तावेज़ जिस पर 1,200 से अधिक लोगों ने हस्ताक्षर किए हैं, जिनमें एंथ्रोपिक के सीईओ डारियो अमोदेई और ओपनएआई के मुख्य वैज्ञानिक जैकब पाचोकी शामिल हैं।
स्रोत: CNews — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार