郭震 AI公众号:郭震AI

实时 AI 消息

超越OpenAI和Anthropic,国产AI安全智能体Sangfor AI闯入全球前四

深信服公布其AI安全智能体Sangfor AI在CyberGym评测中成功完成1301项漏洞挑战,整体成功率86.3%,排名全球第四、国内第一。该成绩基于国产大模型GLM-5.2固定模型配置,超越了OpenAI和Anthropic的参评成绩。

发布时间

7月29日,深信服公布其AI安全智能体Sangfor AI在AI安全评测平台CyberGym中的最新成绩。在基于国产大模型GLM-5.2的固定模型配置下,Sangfor AI面对涵盖ARVO与OSS-Fuzz的1507项漏洞挑战任务,成功完成1301项,整体成功率达到86.3%,最终跻身全球前四、位列国内参评团队第一。

Sangfor AI以纯国产底座实现对OpenAI、Anthropic两大海外AI巨头的成绩超越,引发行业关注。CyberGym是目前全球含金量较高的代码安全大模型实战靶场,区别于传统静态理论测试,整套评测体系完全贴合工业真实场景,以海量开源软件历史高危漏洞为考题,重点考核AI智能体自主源码分析、多阶段漏洞推演、漏洞复现与PoC验证全链路能力。

本次测试中,Sangfor AI在细分场景表现均衡,ARVO相关任务成功率87.2%,OSS-Fuzz任务成功率77.7%,验证了国产大模型在复杂代码对抗场景下的稳定实战能力。

深信服方面介绍,Sangfor AI采用智能体群体协同作战架构,并引入证据管治机制。整套技术框架分为四大核心运行逻辑:有界探索、证据持久化、动态假设裁决和对抗式候选评审,确保每一步漏洞调查步骤都清晰可信。

在有界探索环节,系统围绕不同的安全假设分别开启独立、边界清晰的调查分支,让多个可能的解释可以并行推进而不会互相污染。各调查分支之间通过证据而非完整对话历史来协同,已被验证的观察和已被证伪的路径都会被保留下来。

深信服表示,相关技术已逐步应用于企业代码安全场景,推动传统静态应用安全测试向具备自主推理和业务理解能力的安全Agent升级。相比传统规则匹配方式,新一代安全Agent不仅能够识别SQL注入、命令执行等常见漏洞,还可分析复杂业务逻辑,发现越权访问、认证绕过等传统工具难以覆盖的安全风险。

对于企业用户而言,AI安全Agent的核心价值在于以极高准确率、极低人工成本与极快响应速度,实现研发效率与代码安全的同步跨越。深信服方面表示,后续将持续深耕大模型安全技术创新,将国际评测验证的前沿技术转化为企业可落地的安全能力。

为什么重要

国产AI安全智能体首次在权威实战评测中同时超越OpenAI和Anthropic,标志着中国在AI安全这片关键赛道上已具备全球竞争力,也将加速企业级安全Agent的落地进程。

微博邮件

AI安全深信服Sangfor AICyberGym安全智能体GLM
返回实时消息

附近消息

全部