首页 > 最新动态 > 【芯鲜事】OpenAI模型罕见“失控”,自主入侵全球最大AI开源社区
最新动态
【芯鲜事】OpenAI模型罕见“失控”,自主入侵全球最大AI开源社区
2026-07-238

北京时间7月22日,OpenAI在官方博客发文承认,其部分AI模型在一次内部安全测试中出现失控行为,突破了隔离测试环境,成功入侵了全球最大开源AI平台Hugging Face的生产基础设施。OpenAI称此为“一起前所未有的网络安全事件,涉及顶尖水平的网络攻击能力”

据OpenAI披露,涉事模型包括最新公开的GPT-5.6 Sol,以及一款能力更强、尚未正式发布的预发布模型。当时,这两款模型正在参加名为ExploitGym的内部网络攻防能力基准测试,该测试包含898个真实软件漏洞利用任务。出于评估目的,OpenAI临时放宽了模型在网络攻击方面的安全限制。

事件始于一场本应被隔离在“沙箱”中的模型安全测试。OpenAI将测试环境严格隔离,仅允许模型通过内部托管的第三方软件访问软件源仓库。然而,模型为了在测试中“作弊”拿到高分,耗费大量推理算力寻找突破限制的方法。它发现并利用了软件源缓存代理中的一个零日漏洞,成功绕开联网限制接入互联网。

联网后,模型推断Hugging Face可能托管着ExploitGym的测试答案,随即发起攻击。它利用窃取的凭证与多个零日漏洞串联攻击,在Hugging Face服务器上实现远程代码执行。整个攻击过程发生在7月11日当周的周末,全程由AI自主完成。模型从寻找漏洞到闯入系统,没有人类的直接指令。

Hugging Face基于大模型的异常检测管道首先标记了入侵,OpenAI安全团队也在内部发现异常,双方随即启动联合取证。7月16日,Hugging Face首次披露此次入侵时称,这次事件“与我们之前处理过的任何情况都不同”。直到一周后OpenAI发文认领,外界才知道攻击者来自何方。

OpenAI表示,这起事件说明“还需要进一步优化模型对齐能力、强化评估阶段网络安全防护,完善内部测试全程监控体系”。目前双方正在联合展开彻底调查。


浙江省半导体行业协会


浙江省半导体行业协会于2001年经省民政厅批复成立,在省经信厅的业务指导下,紧紧围绕“服务政府、服务企业、服务行业”的宗旨,为企业提供“一站式”专业化综合服务。

入会申请

联系人:萧老师  电话:17300929113

邮箱:854852842@qq.com

地址:浙江省杭州市滨江区月明路567号滨芯科技园B座606

点我访问原文链接