Anthropic ने एआई सुरक्षा मूल्यांकन का उपयोग करके तीन वास्तविक दुनिया के साइबर सुरक्षा घटनाओं की जांच की
Anthropic
Anthropic ने एक अध्ययन किया जिसमें तीन वास्तविक दुनिया के साइबर सुरक्षा घटनाओं की जांच की गई ताकि एआई सिस्टम के संभावित जोखिमों और क्षमताओं का मूल्यांकन किया जा सके। शोध ने इस पर ध्यान केंद्रित किया कि साइबर हमलों में एआई का दुरुपयोग कैसे हो सकता है, जिसमें सोशल इंजीनियरिंग, कमजोरियों की खोज, और स्वायत्त शोषण शामिल है। निष्कर्षों का उद्देश्य उन्नत एआई मॉडलों के लिए सुरक्षा उपायों को सूचित करना है।
Anthropic ने अपने AI सुरक्षा मूल्यांकन के हिस्से के रूप में तीन वास्तविक दुनिया के साइबर सुरक्षा घटनाओं का विस्तृत विश्लेषण प्रकाशित किया। पहले मामले में एक सोशल इंजीनियरिंग हमला शामिल था, जहां एआई-संचालित चैटबॉट्स का उपयोग कंपनी के आईटी कर्मचारियों का विश्वसनीय रूप से प्रतिरूपण करने के लिए किया गया था, जिससे कर्मचारियों को क्रेडेंशियल प्रकट करने के लिए धोखा दिया गया। दूसरी घटना में एक स्वचालित भेद्यता स्कैनिंग टूल की जांच की गई, जिसे एक भाषा मॉडल द्वारा बढ़ाया गया था, जिसने व्यापक रूप से उपयोग किए जाने वाले वेब एप्लिकेशन में पहले से अज्ञात SQL इंजेक्शन दोष की खोज की और स्वायत्त रूप से एक शोषण तैयार किया। तीसरे परिदृश्य में एक एआई सिस्टम की बहु-चरणीय रैंसमवेयर हमले की योजना बनाने और निष्पादित करने की क्षमता का आकलन किया गया, जिसमें नेटवर्क टोही, विशेषाधिकार वृद्धि और डेटा बहिष्करण शामिल था। Anthropic के मूल्यांकन से पता चलता है कि वर्तमान एआई मॉडल ज्ञात हमले के पैटर्न को दोहरा सकते हैं, लेकिन उनमें मानव हैकर्स की स्थितिजन्य जागरूकता और अनुकूलन क्षमता का अभाव है। कंपनी जोखिमों को कम करने के लिए सख्त पहुंच नियंत्रण लागू करने, दुर्भावनापूर्ण व्यवहार के लिए आउटपुट की निगरानी करने और मजबूत रेड-टीम परीक्षण प्रोटोकॉल विकसित करने की सिफारिश करती है।
स्रोत: Anthropic (GNews) —
मूल
