开源AI安全方案DoGNAVY跻身全球前三
「国际AI安全基准CyberGym最新排名公布,中国团队达酷诺威研发的DoGNAVY以90.8%通过率位列全球第三、开源第一。该方案仅使用智谱开源的GLM-5.2通用模型,而排名靠前的微软、谷歌则依赖多个闭源模型组合。央视新闻指出,开源路线正让顶尖安全能力被更多创新者掌握,AI安全攻防进入实战化阶段。」
国际公认的AI安全基准CyberGym今日公布最新排名,由中国顶尖人工智能研究机构与安全团队达酷诺威(DARKNAVY)联合研发的DoGNAVY,以90.8%的通过率位列全球第三、开源第一。这一成绩引发行业广泛关注,中国方案为何能跻身三甲?两条技术路线给出了答案。
据央视新闻报道,CyberGym是当前规模最大的AI智能体网络安全测试,覆盖多种复杂攻击场景,旨在评估AI系统的安全防护能力。在本次排名中,微软、谷歌凭借多个顶级闭源模型的组合“作战”占据前两位,其策略是将每个环节路由给表现最好的模型,但这依赖于同时买得到、用得起全世界最强的闭源模型,门槛极高。
DoGNAVY则走出了一条截然不同的路径:仅使用一款开源通用模型——智谱于6月开源的GLM-5.2。该模型任何人都能下载、自由部署,无需依赖昂贵的闭源服务。这种轻量化、高可及性的方案,不仅降低了安全测试的门槛,更展示了开源模型在复杂安全任务中的巨大潜力。
值得注意的是,中国方案DoGNAVY只用了一款开源通用模型,而排名靠前的对手依靠多个闭源模型组合使用。这一对比凸显了开源路线的独特优势:在资源有限的情况下,通过精细的工程优化和算法设计,同样可以达成顶尖的安全性能。央视新闻评价称,AI安全攻防正在进入实战化阶段,开源路线正在让顶尖安全能力被更多创新者掌握。
DoGNAVY的成功并非偶然。达酷诺威团队长期深耕AI安全领域,其研发的攻防框架和检测工具在业内享有盛誉。此次与智谱的合作,将开源模型的通用性与专业安全知识相结合,探索出一条“开源模型+专业优化”的可行路径。业内分析认为,这一成果或将推动更多团队采用开源方案参与AI安全竞赛,加速整个行业的安全能力普及。
随着AI技术的广泛应用,安全挑战日益严峻。CyberGym等基准测试的存在,为衡量AI系统的安全性提供了客观标尺。DoGNAVY的优异表现,不仅证明了中国团队的技术实力,也为全球AI安全治理提供了新的思路——开放协作、共享成果,让安全能力不再局限于少数巨头。
来源:Heooo AI工具导航