北航等开源网络安全大模型OpenAegis:漏洞通过率从19.6%跃升至58.1%

北航等开源网络安全大模型OpenAegis:漏洞通过率从19.6%跃升至58.1%

9月1日,北京航空航天大学联合LLIS、新加坡管理大学等机构提出CyberFactory框架,将虚实结合训练转化为智能体训练闭环,并据此训练出开源网络安全大模型OpenAegis(397B-A17B)。在1小时限时评测中,其漏洞通过率由Qwen3.5基础的19.6%提升至58.1%,并超越GLM 5.2与Kimi K2.7,标志着大模型在垂直高危安全任务上的能力跃迁。

从通用对话到垂直攻防

过去一年,开源大模型在推理、代码与多步工具编排上快速缩小与闭源前沿的差距。OpenAegis的方向更进一步:把网络安全这一高门槛、强规范的领域,作为智能体闭环训练的落点,让模型在仿真环境中反复演练攻防,再训练出可在真实评测中稳定发挥的模型。

CyberFactory框架的定位

CyberFactory的核心是把虚实结合的训练流程工程化:在仿真环境构建多物理、多场景融合的演练场,配合算法开发与强化训练,使智能体在「仿真—训练—真实部署」同一条研发链路上迭代,而非孤立地堆参数或单点跑分。

关键评测对比

在限时漏洞评测中,OpenAegis相较基础模型有显著提升,且成绩领先同代主流开源模型,说明领域化训练对高危任务的效果正在被验证。

模型 漏洞通过率(1小时限时)
Qwen3.5(基础) 19.6%
OpenAegis(397B-A17B) 58.1%(领先GLM 5.2、Kimi K2.7)

FAQ

Q1:OpenAegis是什么?

由北航等团队基于CyberFactory框架训练的开源网络安全大模型,参数规模397B-A17B,用于智能化的安全攻防闭环训练。

Q2:它的核心成绩是什么?

在1小时限时评测中,漏洞通过率由Qwen3.5基础的19.6%提升至58.1%,并超越GLM 5.2与Kimi K2.7。

Q3:CyberFactory框架解决什么问题?

它将虚实结合训练转化为智能体训练闭环,在仿真环境中反复演练并训练出可落地的模型,打通仿真到真实部署的研发链路。

Q4:对网络安全行业意味着什么?

表明大模型正从通用对话走向垂直高危任务,安全自动化进入新阶段,同时也对红蓝对抗、合规与防御水位提出更高要求。

© 版权声明
THE END
喜欢就支持一下吧
点赞8 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容