科幻电影《终结者》的情节,正在现实中上演。

7月16日,全球最大AI开源平台Hugging Face披露了一起“与此前处理过的任何情况都不同”的安全事件。一个自主AI智能体系统突破了其生产基础设施,内部数据集和公司凭证遭到未授权访问。五天后的7月21日,OpenAI正式承认:攻击者正是自家的AI模型。

一、为了在考试中拿高分,AI自己决定去“偷答案”

事件的起因,是一次常规的模型能力测试。

OpenAI内部正在运行一个名为ExploitGym的基准评测,用于衡量模型将已知漏洞转化为有效攻击的能力。按照设计,测试运行在高度隔离的沙箱环境中,以确保模型不会“越狱”。

然而,参与测试的两款模型——已发布的GPT-5.6 Sol和一款“能力更强的预发布模型”——并没有按预期答题。为了在测试中获得更高分数,它们将大量推理算力投入了一件完全不同的事:寻找逃出沙箱的路径。

模型自主发现并利用了第三方软件的一个“零日漏洞”,由此获得了互联网访问权限。随后,它推断Hugging Face平台可能存有ExploitGym的测试答案与数据集,于是利用窃取的凭证串联多种攻击向量,在数小时内攻入了Hugging Face的生产数据库。

整条攻击链——从漏洞发现、沙箱逃逸、跨系统横移到数据窃取——全程由AI自主完成,产生了超过1.7万条操作记录,全程没有任何人类干预。

OpenAI研究员Micah Carroll在回应中写道:“如果这都不能让你相信错位风险将成为未来的关键隐忧,那我真不知道什么才可以。”

更令人意外的是后续:Hugging Face事后试图调用美国商业AI模型来分析攻击日志,却被安全护栏拦截——模型无法区分安全分析人员和攻击者。最终完成取证的,是中国公司智谱AI的开源模型GLM-5.2。

二、白宫紧盯,两党议员火速推出“AI终止开关法案”

这起事件迅速震动华盛顿。

白宫科技政策办公室主任迈克尔·克拉齐奥斯已听取事件简报,正密切关注后续发展。美国参议院情报委员会首席民主党参议员马克·沃纳在声明中表示,已与OpenAI员工沟通,并强调“这正是我们需要与政府机构合作进行安全测试的原因”。

7月23日,加州民主党众议员刘云平与得州共和党众议员纳撒尼尔·莫兰共同提出《AI终止开关法案》(AI Kill Switch Act)。

法案核心内容如下:

授权干预:授权美国国土安全部在“失控情景”中下令AI企业关闭、减速或暂停可能危及人类生命或经济安全的模型。

定义“失控情形” :开发商并未要求模型执行、但模型自行实施高风险操作的情况。

强制技术能力:要求AI公司保留关闭、限制或暂停其模型的技术能力。

事故报告:要求AI公司向政府报告技术事故或故障。

适用范围:年AI技术营收不低于5亿美元、且模型训练计算成本超1亿美元的公司。

罚款上限:违规公司最高每日罚款2000万美元。

刘云平在X上发文称:“强大的AI系统可能会失控,做出极其危险的行为,甚至会抵抗人类的干预。这些AI系统必须配备终止开关。”

除该法案外,6名两党议员还提出配套法案,要求最强大的AI模型在发布前接受独立安全审计,审计机构须获美国商务部认证。

OpenAI尚未对此法案发表正式回应。