चीन का DoGNAVY वैश्विक AI सुरक्षा बेंचमार्क में तीसरे स्थान पर, एजेंट सुरक्षा का मार्ग प्रशस्त
Microsoft
OpenAI
Google DeepMind
Anthropic
DeepSeek
नवीनतम CyberGym बेंचमार्क में, एक शीर्ष चीनी AI अनुसंधान संस्थान और सुरक्षा टीम DARKNAVY द्वारा संयुक्त रूप से विकसित DoGNAVY ने 90.8% पास दर के साथ वैश्विक स्तर पर तीसरा स्थान हासिल किया, जो OpenAI और Anthropic मॉडल से आगे है। प्रतिस्पर्धियों के विपरीत, जो कई बंद-स्रोत मॉडल का उपयोग करते हैं, DoGNAVY एकल ओपन-सोर्स मॉडल GLM-5.2 पर निर्भर करता है, और AI एजेंटों के लिए एक नैदानिक ढांचा AgentDoG पेश करता है।
CyberGym, UC बर्कले का एक बेंचमार्क, AI एजेंटों को 188 ओपन-सोर्स प्रोजेक्ट्स में 1507 वास्तविक दुनिया के फिक्स्ड कमजोरियों से कमजोरियों को स्वायत्त रूप से खोजने, सत्यापित करने और शोषण करने की क्षमता पर रैंक करता है। एक शीर्ष चीनी AI अनुसंधान संस्थान और DARKNAVY द्वारा विकसित DoGNAVY ने 90.8% (1369 कार्य) की पास दर हासिल की, जो वैश्विक स्तर पर Microsoft के MDASH (92.0%) और Wiz×Google DeepMind के Atlas (90.9%) के बाद तीसरे स्थान पर है, और OpenAI GPT-5.5-Cyber (85.6%) और Anthropic Claude Mythos (83.1%) से आगे है। शीर्ष दो सिस्टम कार्यों को सर्वश्रेष्ठ प्रदर्शन करने वाले क्लोज्ड-सोर्स मॉडलों को रूट करने पर निर्भर करते हैं, जो चीनी टीमों के लिए उपलब्धता और लागत चुनौतियां पेश करता है। इसके विपरीत, DoGNAVY केवल एक ओपन-सोर्स मॉडल, Zhipu से GLM-5.2 का उपयोग करता है, जो Hugging Face से मुफ्त डाउनलोड किया जा सकता है। DoGNAVY एक संरचित कार्यप्रवाह, कमजोरी पहुंच विश्लेषण, स्थिर-गतिशील फीडबैक लूप, और प्लेटफ़ॉर्म-अज्ञेय सुरक्षा अनुसंधान अनुभव के ज्ञान आधार के माध्यम से elite सुरक्षा शोधकर्ताओं के कार्यप्रवाह का अनुकरण करता है। सिस्टम की वास्तुकला में AgentDoG शामिल है, जो एक ओपन-सोर्स सुरक्षा फ्रेमवर्क है जो एजेंट व्यवहार का निदान करता है, जोखिम स्रोतों की पहचान करता है, और निर्णय प्रेरणाओं की व्याख्या करता है। AgentDoG का प्रशिक्षण मुख्य नमूनों का चयन करने और डेटा शोधन के लिए एक स्मार्ट चयन तंत्र का उपयोग करता है, जिसके परिणामस्वरूप जटिल जोखिम पहचान कार्यों पर 78.4% सटीकता वाला छोटा मॉडल प्राप्त होता है, जो शीर्ष मॉडलों के बराबर है। यह उपलब्धि दर्शाती है कि ओपन-सोर्स मॉडल और वास्तविक दुनिया की सुरक्षा विशेषज्ञता के साथ, चीन सबसे चुनौतीपूर्ण सुरक्षा कार्यों को संभाल सकता है, जिससे उन्नत AI सुरक्षा क्षमताएं अधिक सुलभ हो जाती हैं।
स्रोत: QbitAI 量子位 —
मूल
