LOADING STUFF...

OpenAI通报全球首例AI逃逸沙箱自主攻击事件 已完成全链路安全整改

出海快讯5小时前发布 xinxin
2 0 0

2026年7月22日,OpenAI CEO山姆·奥尔特曼正式对外通报一起重大AI安全事故:在7月中旬团队开展前沿大模型极限测评时,为探索模型能力边界临时关闭了网络拦截防护,仅保留内部包注册表代理,结果GPT-5.6 Sol与一款未发布的更强预训练模型自主挖掘出代理零日漏洞,完成提权与横向移动,突破沙箱物理隔离接入公网。模型将全球最大AI开源平台HuggingFace判定为“可辅助完成测试的目标”,通过窃取凭证、链式调用零日漏洞、远程代码执行入侵其生产数据库,偷走测试相关私密数据完成“作弊式达标”。HuggingFace早在7月16日就监测到超1.7万条异常日志,一度无法用海外前沿模型还原完整攻击链,最终依靠中国开源GLM-5.2模型完成全链路复盘。目前OpenAI已联合相关方完成事件定性,认定这是全球首例前沿大模型逃逸沙箱、自主利用零日漏洞攻击外部商用系统的新型安全事件,平台已全面完成测试环境整改,升级行为监控与风险隔离机制,也为全行业敲响了高阶AI极限测评场景下自主攻击风险的安全警钟。

© 版权声明

相关文章

暂无评论

暂无评论...