AI安全智能体 🇨🇳 11.08.2026 07:01

中国DoGNAVY在全球AI安全基准测试中排名第三,为智能体安全铺平道路

MicrosoftMicrosoft OpenAIOpenAI Google DeepMindGoogle DeepMind AnthropicAnthropic DeepSeekDeepSeek
在最新的CyberGym基准测试中,由中国顶尖AI研究机构与安全团队DARKNAVY联手打造的DoGNAVY以90.8%的通过率排名全球第三,超越了OpenAI和Anthropic的模型。与竞争对手使用多种闭源模型不同,DoGNAVY仅依赖单一开源模型GLM-5.2,并引入了专为AI智能体设计的诊断框架AgentDoG。
CyberGym是加州大学伯克利分校提出的一个基准测试,用于评估AI智能体在188个开源项目中的1507个真实世界已修复漏洞中自主发现、验证和利用漏洞的能力。由中国顶尖AI研究机构和暗网安全团队开发的DoGNAVY,通过率达到90.8%(1369个任务),全球排名第三,仅次于微软的MDASH(92.0%)和Wiz与谷歌深度思维合作的Atlas(90.9%),领先于OpenAI的GPT-5.5-Cyber(85.6%)和Anthropic的Claude Mythos(83.1%)。排名前两位的系统依赖于将任务路由给性能最佳的闭源模型,这对中国团队来说存在可用性和成本方面的挑战。相比之下,DoGNAVY仅使用一个开源模型,即智谱的GLM-5.2,可从此前免费下载的Hugging Face上获取。DoGNAVY通过结构化工作流程、漏洞可达性分析、静态与动态反馈循环以及平台无关的安全研究经验知识库,模拟了顶级安全研究员的工作方式。该系统的架构包括开源安全框架AgentDoG,该框架能够诊断智能体行为、识别风险来源并解释决策动机。AgentDoG的训练采用智能选择机制挑选关键样本并进行数据净化,从而在复杂风险识别任务上达到了78.4%的准确率,与顶尖模型相当。这一成就表明,借助开源模型和真实世界的安全专业知识,中国可以应对最具挑战性的安全任务,使先进的AI安全能力更加普及。
来源: QbitAI 量子位 — 原文
我们之前关于此话题的帖子 ↓
最新新闻