深信服科技AI安全智能体杀入CyberGym全球前四:86.3%漏洞突破率背后,Agent Swarm与国产GLM-5.2联手交卷 2026-07-29 · 36氪 · 事时观察扩展 深信服科技 今日公布其AI安全智能体Sangfor AI在国际权威基准测试CyberGym中的成绩:在依托纯国产基座模型GLM-5.2的固定配置下,系统在1,507项高难度漏洞挑战中成功解决1,301项,综合成功率86.3%,整体排名全球前四、国内第一。与其同场竞技的包括OpenAI、Anthropic、Meta等全球头部厂商的模型与智能体。 这一定位在AI安全赛道上的技术身位,是深信服向政企客户证明"AI+安全"产品力的最新筹码。但评测分数与商业化订单之间,仍有待市场验证的链条。 86.3% 背后的拆解 CyberGym被业内视为评估大模型代码安全实战能力的含金量最高的靶场之一。它不考察理论问答,而是要求模型在真实开源软件源码中自主发现漏洞、复现并生成PoC(概念验证)。本次评测覆盖ARVO和OSS-Fuzz两大高难度漏洞集。 86.3% 综合成功率 1,301 / 1,507 项 87.2% ARVO任务 77.7% OSS-Fuzz任务 全球前四 国内第一 深信服方面介绍,Sangfor AI采用"智能体群体(Agent Swarm)协同作战"架构,核心机制包括: 有界探索 ——多个假设分支并行推演,互不污染; 证据持久化 ——各分支通过证据而非完整对话历史协同,避免重复试错; 动态假设裁决 ——协调层持续评估证据状态,收窄搜索空间; 对抗式候选评审 ——候选输入需通过"是否可复现"和"是否对应目标漏洞"双重检验后方可提交。 GLM-5.2 选型:国产基座模型的战略卡位 Cy bergym评测采用"固定模型配置",即参赛方不能自由切换基座模型。深信服选择GLM-5.2(智谱AI旗下大模型)作为基座,而非国际主流模型,这一决策本身带有明确信号。 GLM-5.2在安全领域的实力近期已持续被验证。就在2026年6月底,代码安全扫描公司Semgrep发布的安全基准测试中,GLM-5.2在多项cyber benchmark上得分超过Anthropic的Claude模型,被业界视为"国产模型在垂直赛道的定向突破" ¹ 。据BenchLM排名,GLM-5.2综合位列全球第五,但安全场景表现尤为突出 ² 。 对深信服而言,基于国产模型做AI安全有三层考量: 合规 ——政企客户对数据主权和模型自主可控有刚性需求; 差异化 ——GLM-5.2在安全垂直领域的表现已实证可对标甚至超越部分国际模型,无需捆绑海外底座; 成本 ——国产开源模型的许可和部署成本显著低于闭源国际模型,有利于规模化交付。 深信服的基本面:正在"换引擎" 这次AI安全能力登榜,发生在深信服业务结构深度调整的窗口期。 指标 2025年 2026年Q1 变化 营业收入 80.43亿元 16.27亿元 +6.96% / +28.91% 归母净利润 3.93亿元 -0.65亿元 +99.52% / 亏损收窄74% 云计算业务占比 49.86% — 首次超越网络安全成第一大收入 网络安全业务占比 44.01% — 同比小幅下降2.46% 员工人数 4,351人 — 较2021年峰值5,849人持续收缩 来源:深信服2025年报、2026年一季报 ³ ⁴ 云计算业务超越网络安全成为第一大收入来源,意味着深信服的收入结构正在从"卖安全硬件/软件"向"卖云计算基础设施+安全增值"迁移。但这一转型也带来了毛利率压力——2025年综合毛利率同比下降2.16个百分点至59.31%,主要因云计算业务中硬件服务器占比提升带来的结构性影响。 公司6月30日股价单日上涨6.51%,市值415亿元;7月1日完成近9,000万元股份回购 ⁵ ,并在7月下旬经历一轮近10%的回调后又回升至103元附近 ⁶ 。市场对深信服"AI+安全+云"的三重逻辑存在分歧,但多家券商给予积极评级,平安证券维持"推荐",东方证券认为AI正催生公司新拐点 ⁷ 。 CyberGym成绩的商业化考题 深信服表示,Sangfor AI的前沿技术正加速沉淀并赋能全线产品,包括提升漏洞检出率、降低人工代码审计成本、减少误报、支持企业将安全检测前移至CI/CD流程。这意味着CyberGym的验证成果将首先落地到深信服已有的SAST(静态应用安全测试)产品线,从规则匹配升级为AI Agent驱动的自主推理。 这一逻辑的顺滑之处在于:深信服在政企客户中已有庞大的存量装机基础。从招投标记录看,公司近一年覆盖了从人保集团、中国电信、中国联通到南方电网、公安系统、医疗机构的广泛客户群 ⁸ 。在这些已部署深信服安全产品的场景中,通过软件升级或模块扩展的方式推广AI安全Agent,转化路径相对直接。 但需关注以下几点: ⬆ 正向信号 ① 国产化信创东风。 GLM-5.2 + 深信服安全能力的组合直接对政务、金融、央企的"纯国产"采购要求形成匹配。 ② VMware替代红利。 IDC数据显示深信服已位列中国超融合市场前五 ⁹ ,VMware被收购后国内替代窗口打开,AI安全能力可作为差异化卖点打包进入云基础设施方案。 ③ 业绩拐点信号。 2026年Q1营收增速28.91%、亏损大幅收窄,现金流创历史最好水平,公司有资源持续投入AI研发。 ⬇ 待验证信号 ① 评测到订单的转化率。 CyberGym排名是技术能力背书,但政企采购的决策周期通常为6-12个月,AI安全Agent目前仍处于"逐步应用"阶段,尚无明确的规模化签约数据佐证。 ② 毛利率持续承压。 云计算业务扩张带来的结构性毛利率下行趋势,可能在AI安全产品尚未规模放量的窗口期拉低整体盈利水平。 ③ 网络安全业务收缩。 2025年网安业务收入同比微降2.46%,说明传统安全产品面临竞争和降价压力。AI安全Agent能否扭转这一趋势,取决于其是"增量功能"还是"换机逻辑"。 ④ 国际排名细节有限。 深信服未披露全球前四中具体超越/落后于哪些厂商的模型版本,也缺少与其他参赛方的分项对比数据,排名含金量有待更多第三方验证。 下一步值得跟踪的验证点 这起事件之后,投资者和行业观察者可重点关注以下信号: AI安全Agent的定价与产品化形态。 是以独立模块/许可证形式销售,还是作为现有产品的免费升级?这将直接影响收入增量测算。 是否在下一季度财报中提及AI相关订单或POC(概念验证)数量。 Q1已实现营收16.27亿元(+28.91%),若Q2能延续增速,AI催化作用的可信度将显著提升。 GLM-5.2后续迭代是否继续与深信服保持深度绑定。 模型基座的持续竞争力直接影响Sangfor AI的能力天花板。 海外市场的测试进展。 CyberGym是国际评测,若深信服借此机会拓展海外安全客户,将是打开新增长曲线的关键信号。 事时观察观点: 深信服CyberGym全球第四的成绩单,在技术上具有标志性——这是国内网安厂商首次在AI安全国际基准中与OpenAI、Anthropic同场竞技并进入前四。支撑这一成绩的三根支柱(GLM-5.2国产基座、Agent Swarm架构、深信服既有安全产品矩阵)均指向"可落地"。但市场对深信服的估值分歧,恰恰集中在"技术能力→产品溢价→订单收入"这一链条的兑现速度和确定性上。CyberGym排名给深信服提供了一张新的"信任入场券",但真正撬动政企订单,还需要更多的客户案例和收入验证。 ¹ 网易智能:深信服AI在CyberGym评测跻身全球前四 ;另见Semgrep安全团队GLM-5.2 vs Claude基准测试报告 ² BenchLM排名显示GLM-5.2综合位列第5,安全赛道表现突出。来源: 网易智能报道 ³ 深信服2025年年报:营收80.43亿元(+6.96%),归母净利润3.93亿元(+99.52%)。来源: 天眼查|深信服工商信息 及人民财讯报道 ⁴ 深信服2026年一季报:营收16.27亿元(+28.91%),净亏损-0.65亿元(收窄74%)。来源: 天眼查|深信服新闻舆情 ⁵ 深信服公告:累计回购849,127股,耗资8,997.39万元。来源: 天眼查|深信服新闻舆情 ⁶ 深信服7月27日收盘价102.50元(+2.45%),此前7月24日曾跌9.68%。来源: 新浪证券 ⁷ 平安证券研报:维持深信服"推荐"评级,AI融合云计算推动发展。来源: 天眼查|深信服新闻舆情 ⁸ 深信服近一年招投标覆盖人保集团、中国电信兰州、中国联通广东、南方电网等。来源: 天眼查|深信服招投标 ⁹ IDC 2025Q4中国超融合市场报告:深信服位列前五。来源: 中文科技资讯