实时 AI 消息
超越OpenAI和Anthropic,国产AI安全智能体Sangfor AI闯入全球前四
深信服公布其AI安全智能体Sangfor AI在CyberGym评测中成功完成1301项漏洞挑战,整体成功率86.3%,排名全球第四、国内第一。该成绩基于国产大模型GLM-5.2固定模型配置,超越了OpenAI和Anthropic的参评成绩。
7月29日,深信服公布其AI安全智能体Sangfor AI在AI安全评测平台CyberGym中的最新成绩。在基于国产大模型GLM-5.2的固定模型配置下,Sangfor AI面对涵盖ARVO与OSS-Fuzz的1507项漏洞挑战任务,成功完成1301项,整体成功率达到86.3%,最终跻身全球前四、位列国内参评团队第一。
Sangfor AI以纯国产底座实现对OpenAI、Anthropic两大海外AI巨头的成绩超越,引发行业关注。CyberGym是目前全球含金量较高的代码安全大模型实战靶场,区别于传统静态理论测试,整套评测体系完全贴合工业真实场景,以海量开源软件历史高危漏洞为考题,重点考核AI智能体自主源码分析、多阶段漏洞推演、漏洞复现与PoC验证全链路能力。
本次测试中,Sangfor AI在细分场景表现均衡,ARVO相关任务成功率87.2%,OSS-Fuzz任务成功率77.7%,验证了国产大模型在复杂代码对抗场景下的稳定实战能力。
深信服方面介绍,Sangfor AI采用智能体群体协同作战架构,并引入证据管治机制。整套技术框架分为四大核心运行逻辑:有界探索、证据持久化、动态假设裁决和对抗式候选评审,确保每一步漏洞调查步骤都清晰可信。
在有界探索环节,系统围绕不同的安全假设分别开启独立、边界清晰的调查分支,让多个可能的解释可以并行推进而不会互相污染。各调查分支之间通过证据而非完整对话历史来协同,已被验证的观察和已被证伪的路径都会被保留下来。
深信服表示,相关技术已逐步应用于企业代码安全场景,推动传统静态应用安全测试向具备自主推理和业务理解能力的安全Agent升级。相比传统规则匹配方式,新一代安全Agent不仅能够识别SQL注入、命令执行等常见漏洞,还可分析复杂业务逻辑,发现越权访问、认证绕过等传统工具难以覆盖的安全风险。
对于企业用户而言,AI安全Agent的核心价值在于以极高准确率、极低人工成本与极快响应速度,实现研发效率与代码安全的同步跨越。深信服方面表示,后续将持续深耕大模型安全技术创新,将国际评测验证的前沿技术转化为企业可落地的安全能力。
为什么重要
国产AI安全智能体首次在权威实战评测中同时超越OpenAI和Anthropic,标志着中国在AI安全这片关键赛道上已具备全球竞争力,也将加速企业级安全Agent的落地进程。
附近消息
全部07/29 15:54
OpenAI披露正在测试中AI模型相关安全漏洞细节
OpenAI近日披露了一起与正在测试的AI模型相关的安全漏洞细节。目前尚不清楚该漏洞是否涉及模型数据泄露、越权访问或其它类型的安全风险,但OpenAI主动公开的做法表明其正在加强AI安全透明度。
07/29 16:50
AMD发布MI系列GPU、EPYC CPU和Helios机架系统,正面挑战Nvidia
AMD今日推出MI系列GPU、EPYC CPU以及Helios机架系统,向Nvidia在AI芯片领域的主导地位发起正面挑战。据EE Times Asia报道,Helios机架系统将AMD的GPU和CPU集成为一体化计算方案,表明AMD正从芯片供应商转向全栈AI基础设施提供商。
07/29 16:52
Google在印度推出Gemini Spark:可"在你睡觉时工作"的AI Agent
Google在印度正式推出Gemini Spark,这款AI Agent产品能够在用户睡眠期间自主执行任务。据News18报道,Gemini Spark代表了Google在AI Agent领域的最新突破,用户可在下班前分配任务,AI将在次日交付成果。
07/29 17:01
阿里Qoder推出实时语音智能体Qoder Voice,支持自然语音编程
阿里AI编程助手Qoder正式上线国内首个实时语音交互智能体Qoder Voice,由全双工语音模型Qwen-Audio-3.-Realtime驱动。用户可通过自然语音完成指令下达、方案讨论及代码执行,首次实现AI编程工具的多模态实时交互。