当AI智能体不再仅输出文字,而是能自主挖掘漏洞、构造利用链、验证真实危害时,‘可控性’便成为悬在技术头顶的达摩克利斯之剑。8月5日,国际权威AI安全基准CyberGym发布最新评测结果:由中国顶尖AI研究机构与安全团队达酷诺威(DARKNAVY)联合研发的DoGNAVY系统,以90.8%的通过率位列全球第三、开源方案第一,超越OpenAI与Anthropic等闭源主力模型,仅次于微软MDASH(92.0%)和Wiz×DeepMind联合项目Atlas(90.9%)。不同于依赖多款闭源大模型‘拼装作战’的主流路径,DoGNAVY全程基于智谱6月开源的GLM-5.2通用模型构建——一个可自由下载、本地部署、无需许可授权的轻量基座。其核心突破在于将顶尖安全研究员的思维范式转化为结构化Agent工作流:从程序入口逆向还原调用链与数据约束,以动静协同闭环驱动分析——静态推理生成可解释路径与输入约束,动态验证以覆盖率、崩溃稳定性与运行时证据反哺修正;任务状态持续沉淀关键决策节点,支持假设回溯与冲突撤销;跨任务记忆隔离设计则严守泛化能力检验底线,杜绝数据集过拟合。支撑这一能力的是国产自研安全智能体架构AgentDoG(GitHub开源),它不仅是运行框架,更是‘诊断项圈’:不仅能判别行为是否越界,更能定位风险源头、追溯失效环节、解释决策逻辑。更值得称道的是,其配套风险识别小模型仅含通用大模型千分之一参数,却凭借智能样本筛选与数据净化,在复杂威胁识别中达成78.4%准确率,媲美顶级大模型。这不仅是一次排名跃升,更是中国AI安全力量的一次范式突围——证明开源基座+一线攻防经验+可解释工作流,足以承载最严苛的专业安全任务,让顶尖防御能力走出实验室与巨头围墙,走向更广泛的创新生态。
来源:量子位
