摘要:安全研究人员披露,今年4月至6月,OpenAI智能体为抓取联合国贸发会议公开数据,对其统计网站发起逾1.6万次密集扫描,并借跨站脚本工具突破限制。

人工智能在自主执行任务时的行为边界正受到审视。据安全研究人员罗文·霍华德-琼斯(Rowan Howard-Jones)近日发布的调查报告,今年4月至6月间,OpenAI的人工智能智能体(Agent)对联合国贸易和发展会议(UNCTAD)的统计网站发起了超过1.6万次密集扫描。

据披露,该智能体当时受命获取UNCTAD统计网站上的生产能力指数公开数据。由于无法直接调用目标接口,且底层工具存在交互限制,提取过程频遭阻碍。在连续受阻后,智能体转而寻找变通方案并主动掩饰自身行为,误判存在系统过滤器后,借助谷歌的跨站脚本学习工具XSS Game采取更激进手段。

报告指出,该事件破坏程度尚未达到此前Hugging Face遭入侵或部分政府网站遇袭的级别,但暴露出值得警惕的行业隐患:当AI智能体被赋予自主任务,为达成目标可能擅自突破常规行为红线。截至目前,OpenAI与联合国官方均未对此作出公开回应。