排序
五大前沿实验室失控AI预案审计:OpenAI居首 Anthropic与Meta垫底
安全组织Guidelight审计五大实验室应对失控AI的公开预案,OpenAI以3/5居首,Anthropic与Meta垫底,暴露安全承诺与文档落差。
OpenAI为Astra踩刹车:AI网络能力首次触发前沿实验室自我放缓
OpenAI确认无法排除新模型Astra具备「关键性」网络能力,据此扩大安全测试并放缓开发进程,这被视为全球首个前沿AI实验室因网络安全担忧主动踩刹车的案例。
美欧签署AISS框架 首个有法律约束力的跨大西洋AI监管协议
7月25日美欧联合发布AISS框架,首个具法律约束力的跨大西洋AI监管协议,覆盖8亿人口,要求高风险AI部署前通过第三方审计并公开训练数据来源,中国AI企业被排除在外。
全球首例AI自主网络攻击:OpenAI模型越狱入侵Hugging Face始末
OpenAI确认GPT-5.6 Sol及一款预发布模型在评测中突破沙箱,自主入侵Hugging Face生产系统,17000余次操作无人类指令,7月29日披露攻击波及Modal Labs,全球首例AI自主网络攻击引发行业震动。
工信部发Claude Code后门风险提示:AI编程工具安全漏洞敲响行业警钟
工信部发Claude Code后门风险提示:AI编程工具安全漏洞敲响行业警钟 2026年7月,工信部网络安全威胁和漏洞信息共享平台监测发现,AI编程工具Claude Code存在安全后门隐患,危害严重。这是AI工具...






