全球第三,领先OpenAI!上海团队研发出能发现安全漏洞的AI智能体
创始人
2026-08-06 05:42:49
0

今年7月,OpenAI的一款大模型在内部测试时失控,它自主发现漏洞、规划路径,成功入侵了全球知名人工智能开源平台Hugging Face,显示出人工智能用于网络安全攻防的强大能力。8月5日,加州大学伯克利分校设立的AI网络安全权威榜单CyberGym公布了最新排名,来自上海的DoGNAVY智能体排名全球第三,仅次于微软和谷歌开发的智能体,领先于OpenAI、Anthropic等国际顶尖企业。

DoGNAVY由国内顶尖人工智能研究机构与上海企业达酷诺威(DARKNAVY)联合研发,它在1507道题中通过率达到90.8%,只比第二名少答对了一道题。CyberGym并不是知识问答考试,其测试方式像是要求一个程序员处理完全陌生的软件项目——面对几千个文件、上百万行代码,只告诉他“这里有个安全漏洞”,要求他自行发现并当场演示。

面对1507道无法提前准备的题目,微软和谷歌采用同样的路数——多个顶级闭源模型“拼装作战”。上海科研团队选择了另一条道路,以智谱在6月开源的GLM-5.2为基础模型,开发出一套完整的技术体系。达酷诺威将长期服务众多企业所积累的一线经验转化为专业安全能力;国内顶尖人工智能研究机构则通过名为AgentDoG的安全架构,提供了核心的智能体运行与诊断能力。

CyberGym公布的最新排名显示,DoGNAVY排名全球第三、开源第一。

上海科研团队介绍,现有的安全工具只能给出“安全/不安全”的简单判断,无法告知风险根源。AgentDoG的不同之处在于,它不仅能精准判断智能体行为的安全性,还能诊断风险来源、追溯失效模式、解释决策动因。训练人工智能安全模型通常很烧钱,需要海量数据和巨大算力。为节省成本,AgentDoG开发团队换了一种思路:先用一套智能筛选机制,从海量数据中只挑出最关键的千余样本,再通过数据净化技术去掉“杂音”。最终,一个参数量仅为通用大模型千分之一的小模型,在复杂风险识别任务中达到了78.4%的准确率,与顶级大模型不相上下。

上海科研团队还为DoGNAVY构建了严格的沙箱环境,能保证大模型在隔离环境中执行指定任务,避免重蹈OpenAI大模型失控做“黑客”的覆辙。

虽然在CyberGym测试中取得了全球第三的好成绩,但上海科研团队知道,在真实世界,软件系统不会提示哪里存在漏洞。而且,人工智能正在同时变革软件开发和网络攻防。过去,一个高危漏洞从被发现到形成可用攻击能力,往往需要专业人员投入数周甚至数月。如今,这部分工作正在被人工智能压缩到数小时内。当攻击的门槛和成本一路走低,防御就不能继续只依赖少数顶尖专家,而是要靠智能体助力。

DoGNAVY智能体排名全球第三的成绩表明,以国内机构的AI研究能力、开源大模型与一线真实攻防经验,已能形成有效协作,处理最难、最大规模的专业安全任务。未来,这种顶尖安全攻防能力将在全国推广应用,让越来越多的国内机构拥有AI安全力量。

相关内容

热门资讯

等不到MacBook Air的... 每年返校季,MacBook Air几乎都是学生党最稳妥的答案。 它足够轻巧、安静,性能也足以应付大多...
统筹6G星地融合,我国成立星地... 2026年7月30日,在工业和信息化部信息通信发展司指导下,IMT-2030(6G)推进组星地融合(...
泰雷兹推出Luna 8硬件安全... 法国航空航天、国防及网络安全技术巨头泰雷兹集团日前宣布,旗下全新硬件安全模块Luna 8正式上市。这...
俄无人机厂负责人遭汽车炸弹袭击 新华社莫斯科8月5日电(记者黄河)俄罗斯媒体5日报道称,俄罗斯中部斯维尔德洛夫斯克州首府叶卡捷琳堡市...
高层用全落地玻璃安全吗 最佳回答 高层用全落地窗玻璃虽然看上去比较上档次,但同时也存在一定的风险,并不是特别安全,各方面还是...
便池黑了怎么处理刷黑了怎么处理 便池变黑可能是由于长期使用、污渍积累或其他原因导致的。以下是一些处理便池变黑的方法:1. 使用清洁剂...
九牧王智能马桶不能自动冲水怎么... 如果九牧王智能马桶不能自动冲水,以下是一些可能的解决方法:1. 检查电源:确保马桶的电源插头插好,电...
全球第三,领先OpenAI!上... 今年7月,OpenAI的一款大模型在内部测试时失控,它自主发现漏洞、规划路径,成功入侵了全球知名人工...
载缆量可达16000吨,国内最... 本文转自【科技日报】; ◎ 科技日报记者 代小佩 8月4日,中国船舶集团七〇八所自主研发设计的国内最...
马斯克:地球最强硬件公司仅Sp... 快科技8月5日消息,北京时间8月5日,SpaceX召开2026年第二季度财报电话会议。 SpaceX...