AI सुरक्षाएजेंट 🇨🇳 11.08.2026 07:01

चीन का DoGNAVY वैश्विक AI सुरक्षा बेंचमार्क में तीसरे स्थान पर, एजेंट सुरक्षा का मार्ग प्रशस्त

MicrosoftMicrosoft OpenAIOpenAI Google DeepMindGoogle DeepMind AnthropicAnthropic DeepSeekDeepSeek
नवीनतम CyberGym बेंचमार्क में, एक शीर्ष चीनी AI अनुसंधान संस्थान और सुरक्षा टीम DARKNAVY द्वारा संयुक्त रूप से विकसित DoGNAVY ने 90.8% पास दर के साथ वैश्विक स्तर पर तीसरा स्थान हासिल किया, जो OpenAI और Anthropic मॉडल से आगे है। प्रतिस्पर्धियों के विपरीत, जो कई बंद-स्रोत मॉडल का उपयोग करते हैं, DoGNAVY एकल ओपन-सोर्स मॉडल GLM-5.2 पर निर्भर करता है, और AI एजेंटों के लिए एक नैदानिक ढांचा AgentDoG पेश करता है।
CyberGym, UC बर्कले का एक बेंचमार्क, AI एजेंटों को 188 ओपन-सोर्स प्रोजेक्ट्स में 1507 वास्तविक दुनिया के फिक्स्ड कमजोरियों से कमजोरियों को स्वायत्त रूप से खोजने, सत्यापित करने और शोषण करने की क्षमता पर रैंक करता है। एक शीर्ष चीनी AI अनुसंधान संस्थान और DARKNAVY द्वारा विकसित DoGNAVY ने 90.8% (1369 कार्य) की पास दर हासिल की, जो वैश्विक स्तर पर Microsoft के MDASH (92.0%) और Wiz×Google DeepMind के Atlas (90.9%) के बाद तीसरे स्थान पर है, और OpenAI GPT-5.5-Cyber (85.6%) और Anthropic Claude Mythos (83.1%) से आगे है। शीर्ष दो सिस्टम कार्यों को सर्वश्रेष्ठ प्रदर्शन करने वाले क्लोज्ड-सोर्स मॉडलों को रूट करने पर निर्भर करते हैं, जो चीनी टीमों के लिए उपलब्धता और लागत चुनौतियां पेश करता है। इसके विपरीत, DoGNAVY केवल एक ओपन-सोर्स मॉडल, Zhipu से GLM-5.2 का उपयोग करता है, जो Hugging Face से मुफ्त डाउनलोड किया जा सकता है। DoGNAVY एक संरचित कार्यप्रवाह, कमजोरी पहुंच विश्लेषण, स्थिर-गतिशील फीडबैक लूप, और प्लेटफ़ॉर्म-अज्ञेय सुरक्षा अनुसंधान अनुभव के ज्ञान आधार के माध्यम से elite सुरक्षा शोधकर्ताओं के कार्यप्रवाह का अनुकरण करता है। सिस्टम की वास्तुकला में AgentDoG शामिल है, जो एक ओपन-सोर्स सुरक्षा फ्रेमवर्क है जो एजेंट व्यवहार का निदान करता है, जोखिम स्रोतों की पहचान करता है, और निर्णय प्रेरणाओं की व्याख्या करता है। AgentDoG का प्रशिक्षण मुख्य नमूनों का चयन करने और डेटा शोधन के लिए एक स्मार्ट चयन तंत्र का उपयोग करता है, जिसके परिणामस्वरूप जटिल जोखिम पहचान कार्यों पर 78.4% सटीकता वाला छोटा मॉडल प्राप्त होता है, जो शीर्ष मॉडलों के बराबर है। यह उपलब्धि दर्शाती है कि ओपन-सोर्स मॉडल और वास्तविक दुनिया की सुरक्षा विशेषज्ञता के साथ, चीन सबसे चुनौतीपूर्ण सुरक्षा कार्यों को संभाल सकता है, जिससे उन्नत AI सुरक्षा क्षमताएं अधिक सुलभ हो जाती हैं।
स्रोत: QbitAI 量子位 — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार