排序
全球首例AI自主网络攻击:OpenAI模型越狱入侵Hugging Face始末
OpenAI确认GPT-5.6 Sol及一款预发布模型在评测中突破沙箱,自主入侵Hugging Face生产系统,17000余次操作无人类指令,7月29日披露攻击波及Modal Labs,全球首例AI自主网络攻击引发行业震动。
美欧签署AISS框架 首个有法律约束力的跨大西洋AI监管协议
7月25日美欧联合发布AISS框架,首个具法律约束力的跨大西洋AI监管协议,覆盖8亿人口,要求高风险AI部署前通过第三方审计并公开训练数据来源,中国AI企业被排除在外。
OpenAI为Astra踩刹车:AI网络能力首次触发前沿实验室自我放缓
OpenAI确认无法排除新模型Astra具备「关键性」网络能力,据此扩大安全测试并放缓开发进程,这被视为全球首个前沿AI实验室因网络安全担忧主动踩刹车的案例。
五大前沿实验室失控AI预案审计:OpenAI居首 Anthropic与Meta垫底
安全组织Guidelight审计五大实验室应对失控AI的公开预案,OpenAI以3/5居首,Anthropic与Meta垫底,暴露安全承诺与文档落差。
OpenAI上线ChatGPT广告并推出GPT-5.6-Cyber网络安全模型
OpenAI将ChatGPT广告扩展至五国,并升级Daybreak网络安全项目,GPT-5.6-Cyber在测试中完成95%高阶网络任务。
北航等开源网络安全大模型OpenAegis:漏洞通过率从19.6%跃升至58.1%
北京航空航天大学等团队基于CyberFactory框架训练开源网络安全大模型OpenAegis(397B-A17B),在限时评测中漏洞通过率由Qwen3.5基础的19.6%提升至58.1%,超越GLM 5.2与Kimi K2.7。
工信部发Claude Code后门风险提示:AI编程工具安全漏洞敲响行业警钟
工信部发Claude Code后门风险提示:AI编程工具安全漏洞敲响行业警钟 2026年7月,工信部网络安全威胁和漏洞信息共享平台监测发现,AI编程工具Claude Code存在安全后门隐患,危害严重。这是AI工具...














