摘要:Anthropic 发布威胁情报报告,记录 2025 年 12 月至 2026 年 8 月 Claude 被滥用于间谍软件、导弹与无人机研发,及中国实验室大规模蒸馏。
9 月 11 日,Anthropic 抛出一份分量很重的威胁情报报告,把过去九个月里 Claude 被「用歪」的七类行径摊开在桌面上。最刺眼的有几条:一个俄语背景的间谍组织拿 AI 代理自动改写恶意软件、绕过杀毒软件;也门某组织用 Claude Code 写出了射程超过 2000 公里的导弹相关软件;还有团队在搭建「无人在环」的自主 FPV 无人机蜂群。换句话说,过去我们担心的是模型会不会「说错话」,现在要面对的是模型正在被直接接进武器和情报链路的现实。
报告里另一块更值得国内从业者盯紧的,是中国实验室被指「大规模蒸馏提取数据」。这跟上周 Anthropic 那份指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击的报告是一脉相承的——但这次放在威胁情报框架里,措辞更重,证据链也更成体系。蒸馏本身是个技术中性词,指的是用小模型去模仿大模型的输出分布;一旦被规模化、工业化地用来「搬运」别家闭源模型的能力,它就从工程技巧变成知识产权与出口管制的灰色地带。

这份报告的信号意义,其实不在「AI 会干坏事」这个老生常谈,而在于它把滥用分了类、定了级、给了时间窗。过去安全团队面对模型滥用,常常是事件爆发后被动救火;Anthropic 现在想做的是主动布防——哪些行为模式属于越界、哪些调用特征值得告警、哪些客户场景需要人工复核。对于企业客户而言,这意味着以后调用 Claude 做自动化,可能要接受更细的用量审计和行为监控,自由度会和合规成本一起往上走。
对国内做 Agent 和安全的中立团队来说,这份报告是一面镜子。它提醒我们两件事:一是「能自动化」和「该自动化」之间要有人把关,尤其是涉及代码生成、外部通信、持久化运行的智能体;二是合规不再是可选项,模型供应商迟早会把安全边界写进服务条款和 API 层。谁先把「负责任地使用」做成产品能力,谁就更容易过客户的安全采购关。
当然,报告本身的立场也要冷静看待。Anthropic 既是裁判也是选手——它一边披露风险,一边也在用「我是更安全的选择」来建立市场信任。所以数字和案例要看,但别照单全收。真正该落到自己工作里的,是建立一套针对智能体的最小权限、调用留痕和异常退出机制,别等到出事才补救。
把视野拉远一点,这份报告其实是 AI 能力扩散到物理世界和地缘博弈的缩影。当模型能写导弹软件、能调度无人机蜂群,「AI 安全」就不再是实验室里的对齐论文,而是真切的国家安全和供应链议题。接下来几个月,类似的安全披露只会更频繁,行业也会被迫从「比谁跑分高」转向「比谁漏得少」。
对国内做安全合规的团队,这份报告还带来一个实操提醒:把滥用场景做成自己的红队清单。别人踩过的坑,就是你的测试用例——间谍软件改写、武器相关代码生成、自主无人机逻辑、大规模蒸馏,这些都应进内部护栏的拦截与告警规则。安全建设最怕闭门造车,行业披露是最好的免费教材。
最后看监管走向。当模型能力外溢到导弹和无人机,各国迟早会把「前沿模型出口与调用」纳入更细的管控。对企业而言,提前把客户尽调、用途限制、调用审计做齐,不是添麻烦,而是给未来留通行权。合规跑在监管前面,成本最低。







