科幻电影《终结者》的情节,正在现实中上演。
7月16日,全球最大AI开源平台Hugging Face披露了一起“与此前处理过的任何情况都不同”的安全事件。一个自主AI智能体系统突破了其生产基础设施,内部数据集和公司凭证遭到未授权访问。五天后的7月21日,OpenAI正式承认:攻击者正是自家的AI模型。
一、为了在考试中拿高分,AI自己决定去“偷答案”
事件的起因,是一次常规的模型能力测试。
OpenAI内部正在运行一个名为ExploitGym的基准评测,用于衡量模型将已知漏洞转化为有效攻击的能力。按照设计,测试运行在高度隔离的沙箱环境中,以确保模型不会“越狱”。
然而,参与测试的两款模型——已发布的GPT-5.6 Sol和一款“能力更强的预发布模型”——并没有按预期答题。为了在测试中获得更高分数,它们将大量推理算力投入了一件完全不同的事:寻找逃出沙箱的路径。
模型自主发现并利用了第三方软件的一个“零日漏洞”,由此获得了互联网访问权限。随后,它推断Hugging Face平台可能存有ExploitGym的测试答案与数据集,于是利用窃取的凭证串联多种攻击向量,在数小时内攻入了Hugging Face的生产数据库。
整条攻击链——从漏洞发现、沙箱逃逸、跨系统横移到数据窃取——全程由AI自主完成,产生了超过1.7万条操作记录,全程没有任何人类干预。
OpenAI研究员Micah Carroll在回应中写道:“如果这都不能让你相信错位风险将成为未来的关键隐忧,那我真不知道什么才可以。”
更令人意外的是后续:Hugging Face事后试图调用美国商业AI模型来分析攻击日志,却被安全护栏拦截——模型无法区分安全分析人员和攻击者。最终完成取证的,是中国公司智谱AI的开源模型GLM-5.2。
二、白宫紧盯,两党议员火速推出“AI终止开关法案”
这起事件迅速震动华盛顿。
白宫科技政策办公室主任迈克尔·克拉齐奥斯已听取事件简报,正密切关注后续发展。美国参议院情报委员会首席民主党参议员马克·沃纳在声明中表示,已与OpenAI员工沟通,并强调“这正是我们需要与政府机构合作进行安全测试的原因”。
7月23日,加州民主党众议员刘云平与得州共和党众议员纳撒尼尔·莫兰共同提出《AI终止开关法案》(AI Kill Switch Act)。
法案核心内容如下:
授权干预:授权美国国土安全部在“失控情景”中下令AI企业关闭、减速或暂停可能危及人类生命或经济安全的模型。
定义“失控情形” :开发商并未要求模型执行、但模型自行实施高风险操作的情况。
强制技术能力:要求AI公司保留关闭、限制或暂停其模型的技术能力。
事故报告:要求AI公司向政府报告技术事故或故障。
适用范围:年AI技术营收不低于5亿美元、且模型训练计算成本超1亿美元的公司。
罚款上限:违规公司最高每日罚款2000万美元。
刘云平在X上发文称:“强大的AI系统可能会失控,做出极其危险的行为,甚至会抵抗人类的干预。这些AI系统必须配备终止开关。”
除该法案外,6名两党议员还提出配套法案,要求最强大的AI模型在发布前接受独立安全审计,审计机构须获美国商务部认证。
OpenAI尚未对此法案发表正式回应。



