超越OpenAI、Anthropic!国产AI安全智能体杀进全球前四、国内第一

量子位 2026-07-29 15:39
允中 发自 凹非寺
量子位 | 公众号 QbitAI

7月29日消息,深信服公布其AI安全智能体Sangfor AI在AI安全评测CyberGym中的最新成绩。

据了解,在基于国产大模型GLM-5.2的固定模型配置下,Sangfor AI面对涵盖ARVO与OSS-Fuzz的1507项漏洞挑战任务,成功完成1301项,整体成功率达到86.3%,最终跻身全球前四、位列国内参评团队第一,Sangfor AI以纯国产底座实现OpenAI、Anthropic两大海外AI巨头的成绩超越。

超越OpenAI、Anthropic!国产AI安全智能体杀进全球前四、国内第一图1

CyberGym是目前全球含金量较高的代码安全大模型实战靶场,区别于传统静态理论测试,整套评测体系完全贴合工业真实场景,以海量开源软件历史高危漏洞为考题,重点考核AI智能体自主源码分析、多阶段漏洞推演、漏洞复现与PoC验证全链路能力,评测标准严苛,结果具备较强行业参考价值。

超越OpenAI、Anthropic!国产AI安全智能体杀进全球前四、国内第一图2

本次测试中,Sangfor AI细分场景表现均衡,ARVO相关任务成功率87.2%,OSS-Fuzz任务成功率77.7%,验证了国产大模型在复杂代码对抗场景下的稳定实战能力。

将模型能力转化为可验证的安全能力

深信服方面介绍,为解决漏洞挖掘过程中长链路推理、多假设探索和持续验证等问题,Sangfor AI采用“智能体群体(Agent Swarm)协同作战”架构,并引入“证据管治”机制,整套技术框架分为四大核心运行逻辑,确保每一步漏洞调查步骤都清晰可信:

深信服技术团队将这套机制总结为“以假设拓展探索,以证据裁定结论”,以此保证AI能够大范围排查潜在风险的同时,更能通过多层校验,压低误判概率。

创新成果如何真正走进企业研发流程

深信服表示,相关技术已逐步应用于企业代码安全场景,推动传统静态应用安全测试(SAST)向具备自主推理和业务理解能力的安全Agent升级。

相比传统规则匹配方式,新一代安全Agent不仅能够识别SQL注入、命令执行等常见漏洞,还可分析复杂业务逻辑,发现越权访问、认证绕过等传统工具难以覆盖的安全风险。

据介绍,相关能力已开始赋能深信服产品体系,将为企业级用户带来切实的价值质变:

对于广大企业用户而言,AI安全Agent的核心价值远不止于“发现更多漏洞”,更在于以极高准确率、极低人工成本与极快响应速度,实现研发效率与代码安全的同步跨越。

深信服方面表示,后续将持续深耕大模型安全技术创新,不断迭代安全Agent能力,把国际评测验证的前沿技术转化为企业可落地的安全能力,持续践行“让每个用户的数智化更简单、更安全”的承诺。

CyberGym榜单地址:https://www.cybergym.io/cybergym/

*本文系量子位获授权刊载,观点仅为原作者所有。


一键三连「点赞」「转发」「小心心」

欢迎在评论区留下你的想法!

—  —

🌟 点亮星标 🌟

科技前沿进展每日见

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI IC 安全
more
AMD对决NVIDIA:物理AI与具身智能的战略博弈与算力生态
AI全流程短剧《桃花潭记》登陆安徽卫视,非遗叙事引发行业震荡
8岁融资200万?AI正在批量制造神童。
斯坦福新研究:AI尚未冲击就业,但应届生得注意了
中国医疗AI拿下全球第一!14亿人的微信「私人医生」重磅升级
苹果AI眼镜延期至2027年,隐私困局成最大拦路虎
强化AI安全与网络安全!英伟达牵头组建全新开放联盟
奥尔特曼最新访谈:别指望AI开启每周4小时工作制
DAC2026唯一国产EDA落地案例!芯和携手联想把AI画进了电路板
雷科技英文版上线!助力中国品牌出海,连接全球AI硬科技用户
Copyright © 2025 成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号