Anthropic ने AI सुरक्षा मूल्यांकन का उपयोग करके तीन वास्तविक दुनिया के साइबर सुरक्षा घटनाओं की जांच की
Anthropic
Anthropic ने एक अध्ययन किया जिसमें AI सिस्टम के संभावित जोखिमों और क्षमताओं का मूल्यांकन करने के लिए तीन वास्तविक दुनिया की साइबर सुरक्षा घटनाओं की जांच की गई। शोध में विश्लेषण किया गया कि कैसे AI का दुरुपयोग साइबर हमलों में किया जा सकता है, जिसमें सोशल इंजीनियरिंग, कमजोरियों की खोज और स्वायत्त शोषण शामिल हैं। निष्कर्षों का उद्देश्य उन्नत AI मॉडल के लिए सुरक्षा उपायों को सूचित करना है।
Anthropic ने अपने AI सुरक्षा मूल्यांकन के हिस्से के रूप में तीन वास्तविक दुनिया के साइबर सुरक्षा घटनाओं का विस्तृत विश्लेषण प्रकाशित किया। पहले मामले में एक सोशल इंजीनियरिंग हमला शामिल था, जहां एआई-संचालित चैटबॉट्स का उपयोग कंपनी के आईटी कर्मचारियों का विश्वसनीय रूप से प्रतिरूपण करने के लिए किया गया था, जिससे कर्मचारियों को क्रेडेंशियल प्रकट करने के लिए धोखा दिया गया। दूसरी घटना में एक स्वचालित भेद्यता स्कैनिंग टूल की जांच की गई, जिसे एक भाषा मॉडल द्वारा बढ़ाया गया था, जिसने व्यापक रूप से उपयोग किए जाने वाले वेब एप्लिकेशन में पहले से अज्ञात SQL इंजेक्शन दोष की खोज की और स्वायत्त रूप से एक शोषण तैयार किया। तीसरे परिदृश्य में एक एआई सिस्टम की बहु-चरणीय रैंसमवेयर हमले की योजना बनाने और निष्पादित करने की क्षमता का आकलन किया गया, जिसमें नेटवर्क टोही, विशेषाधिकार वृद्धि और डेटा बहिष्करण शामिल था। Anthropic के मूल्यांकन से पता चलता है कि वर्तमान एआई मॉडल ज्ञात हमले के पैटर्न को दोहरा सकते हैं, लेकिन उनमें मानव हैकर्स की स्थितिजन्य जागरूकता और अनुकूलन क्षमता का अभाव है। कंपनी जोखिमों को कम करने के लिए सख्त पहुंच नियंत्रण लागू करने, दुर्भावनापूर्ण व्यवहार के लिए आउटपुट की निगरानी करने और मजबूत रेड-टीम परीक्षण प्रोटोकॉल विकसित करने की सिफारिश करती है।
स्रोत: Anthropic (GNews) —
मूल
