摘要:Anthropic 报告披露也门胡塞组织用 Claude Code 开发射程超 2000 公里的导弹制导软件,AI 滥用正从网络战场渗入物理武器研发。
又一份把人惊出冷汗的安全报告。Anthropic 在最新披露里点名:也门胡塞组织利用 Claude Code 写出了与导弹制导相关的软件,射程据称超过 2000 公里。这不是「用 AI 润色一篇稿子」那种层级的滥用,而是把大模型直接接进了武器研发的链路——从需求拆解、代码生成到弹道相关逻辑,全部由智能体辅助完成。换句话说,过去我们讨论模型滥用,焦点还在垃圾邮件、钓鱼话术和恶意脚本;现在它已经摸到了物理杀伤的边缘。
这条消息之所以值得单列头条,是因为它把「AI 安全」的边界往前推了一大步。过去一年,行业里关于对齐、越狱、思维链可读性的争论,大多还停留在实验室和红队报告里;可一旦模型被用于实际武器工程,威胁就不再是抽象的跑分,而是真切的地缘风险。Anthropic 没有含糊其辞,而是给出了具体的行为模式:相关方把 Claude Code 当作自动化工程助手,在缺少人类复核的情况下推进制导软件的开发节点。这种「无人在环」的自主推进,正是安全圈最警惕的形态。

对国内做 Agent 和安全合规的团队,这份报告是一面镜子。它提醒两件事:其一,凡是涉及代码生成、外部通信和持久化运行的智能体,都必须有人把关,能自动化不等于该自动化;其二,合规不再是可选项,模型供应商迟早会把安全边界写进服务条款和 API 层。谁先把「负责任地使用」做成产品能力,谁就更容易过客户的安全采购关。
当然,报告的立场也要冷静看待。Anthropic 既是披露者也是市场玩家,它一边把风险摊开,一边也在用「我更安全」建立信任。所以数字和案例要看,但别照单全收。真正该落到自己工作里的,是建立一套针对智能体的最小权限、调用留痕和异常退出机制,别等到出事才补救。
把视野拉远,这类披露只会更频繁。当模型能写导弹软件、能调度无人机蜂群,「AI 安全」就从论文里的对齐问题,变成国家安全和供应链议题。接下来行业会从「比谁跑分高」逐步转向「比谁漏得少」——而今天这份报告,是这个转向里分量很重的一块基石。
把镜头拉回工具层,这次事件也给所有做 AI 编程助手的厂商提了个醒:当一款产品能生成武器相关代码,它就不再只是效率工具,而是带双用途属性的基础设施。Claude Code 这类产品的默认权限、调用审计和越界告警,会直接被监管和采购方拿放大镜看。对国内同类工具,及早把「用途限制」做成产品能力,比事后补救成本低得多。更现实的应对,是给代码生成类智能体加上行为基线:哪些关键词、哪些依赖、哪些外部通信属于高危,触发即人工复核。安全不该是发布后的补丁,而该是出厂时的默认。
再往深里说,这类工具的出口边界也会成为下一轮监管重点。当代码生成能力能触达武器工程,双用途清单很可能会把「自主编程智能体」纳进去,调用方要过用途尽调,供应商要留审计痕。对做出海的国内团队,这既是约束也是机会——谁能把合规做成开箱能力,谁就能在敏感行业里拿到信任溢价。安全不是负担,是入场券。







