• 最近访问:
发表于 2026-08-06 04:19:30 股吧网页版
全球第三,领先OpenAI!上海团队研发出能发现安全漏洞的AI智能体
来源:上观新闻

  今年7月,OpenAI的一款大模型在内部测试时失控,它自主发现漏洞、规划路径,成功入侵了全球知名人工智能开源平台Hugging Face,显示出人工智能用于网络安全攻防的强大能力。8月5日,加州大学伯克利分校设立的AI网络安全权威榜单CyberGym公布了最新排名,来自上海的DoGNAVY智能体排名全球第三,仅次于微软和谷歌开发的智能体,领先于OpenAI、Anthropic等国际顶尖企业。

  DoGNAVY由国内顶尖人工智能研究机构与上海企业达酷诺威(DARKNAVY)联合研发,它在1507道题中通过率达到90.8%,只比第二名少答对了一道题。CyberGym并不是知识问答考试,其测试方式像是要求一个程序员处理完全陌生的软件项目——面对几千个文件、上百万行代码,只告诉他“这里有个安全漏洞”,要求他自行发现并当场演示。

  面对1507道无法提前准备的题目,微软和谷歌采用同样的路数——多个顶级闭源模型“拼装作战”。上海科研团队选择了另一条道路,以智谱在6月开源的GLM-5.2为基础模型,开发出一套完整的技术体系。达酷诺威将长期服务众多企业所积累的一线经验转化为专业安全能力;国内顶尖人工智能研究机构则通过名为AgentDoG的安全架构,提供了核心的智能体运行与诊断能力。

CyberGym公布的最新排名显示,DoGNAVY排名全球第三、开源第一。

  上海科研团队介绍,现有的安全工具只能给出“安全/不安全”的简单判断,无法告知风险根源。AgentDoG的不同之处在于,它不仅能精准判断智能体行为的安全性,还能诊断风险来源、追溯失效模式、解释决策动因。训练人工智能安全模型通常很烧钱,需要海量数据和巨大算力。为节省成本,AgentDoG开发团队换了一种思路:先用一套智能筛选机制,从海量数据中只挑出最关键的千余样本,再通过数据净化技术去掉“杂音”。最终,一个参数量仅为通用大模型千分之一的小模型,在复杂风险识别任务中达到了78.4%的准确率,与顶级大模型不相上下。

  上海科研团队还为DoGNAVY构建了严格的沙箱环境,能保证大模型在隔离环境中执行指定任务,避免重蹈OpenAI大模型失控做“黑客”的覆辙。

  虽然在CyberGym测试中取得了全球第三的好成绩,但上海科研团队知道,在真实世界,软件系统不会提示哪里存在漏洞。而且,人工智能正在同时变革软件开发和网络攻防。过去,一个高危漏洞从被发现到形成可用攻击能力,往往需要专业人员投入数周甚至数月。如今,这部分工作正在被人工智能压缩到数小时内。当攻击的门槛和成本一路走低,防御就不能继续只依赖少数顶尖专家,而是要靠智能体助力。

  DoGNAVY智能体排名全球第三的成绩表明,以国内机构的AI研究能力、开源大模型与一线真实攻防经验,已能形成有效协作,处理最难、最大规模的专业安全任务。未来,这种顶尖安全攻防能力将在全国推广应用,让越来越多的国内机构拥有AI安全力量。

郑重声明:用户在财富号/股吧/博客等社区发表的所有信息(包括但不限于文字、视频、音频、数据及图表)仅代表个人观点,与本网站立场无关,不对您构成任何投资建议,据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容,远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息,谨防上当受骗!
作者:您目前是匿名发表   登录 | 5秒注册 作者:,欢迎留言 退出发表新主题
温馨提示: 1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。《东方财富社区管理规定》

扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-61278686 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:4000300059/952500