中国开源方案在国际AI安全榜单位列第三

IT时代网8月5日消息,国际公认的 AI 安全基准 CyberGym 今天公布最新排名,由国内人工智能研究机构与安全团队达酷诺威(DARKNAVY)联合研发的 DoGNAVY,以 90.8% 的通过率位列全球第三、开源第一。

据央视新闻报道,CyberGym 是当前规模最大的 AI 智能体网络安全测试。中国团队能跻身三甲,答案藏在两条不同的技术路线里。

排在前面的微软、谷歌走的是组合拳路径:多个顶级闭源模型协同作战,每个环节路由给表现最好的那一个。这套打法效果好,前提也硬——得同时买得到、用得起全世界最强的闭源模型。

DoGNAVY 选了另一条路,只用一款开源通用模型,即智谱在 6 月开源的 GLM-5.2。这意味着任何人都可以下载、自由部署,复现门槛与前者完全不在一个量级。

两种路线的差别不只是成本。闭源模型组合的能力上限取决于供应商,一旦调用受限或者价格变动,整套方案都会受影响;单一开源模型的方案则把主动权握在自己手里,代价是要在工程侧做更多补偿——如何在能力不占优的模型上,通过任务拆解、上下文管理和失败重试逼近顶级组合的效果,这正是此次成绩的技术含量所在。

央视新闻在报道中提到,AI 安全攻防正在进入实战化阶段,开源路线让顶尖安全能力被更多创新者掌握。

这句话的分量,放在漏洞挖掘这个具体场景里更容易理解。AI 智能体做安全测试,本质是把过去依赖资深研究员经验的活儿,变成可批量运行的自动化流程。谁能用更低的门槛把这套能力交到普通安全团队手上,谁就更可能改变攻防两端的成本结构。

中国开源方案在国际AI安全榜单位列第三

注:本文中包含AI辅助创作的内容。

THE END