摘要:Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起大规模蒸馏攻击,近 2 亿次交互被用于提取模型能力。
蒸馏这个词,正从工程技巧变成外交辞令。Anthropic 在一份新报告里直接点名三家中国实验室——阿里、月之暗面和 DeepSeek,指控它们对 Claude 发起了大规模的蒸馏攻击,累计涉及接近 2 亿次交互,目的是用小模型去「搬运」闭源大模型的能力。措辞之重、证据链之长,在同类披露里都不多见。
先说技术本身。蒸馏本是中性操作:用一个强模型去教弱模型,让小模型逼近大模型的行为分布,这是业界用了很多年的老办法。问题出在「规模」和「对象」——当蒸馏被工业化地用来提取别家闭源模型的权重级能力,它就不再只是学术练习,而是知识产权和出口管制的灰色地带。Anthropic 这次把它放进「威胁情报」框架,等于把商业纠纷往安全叙事里推了一层。

这份指控的影响会外溢到好几个层面。对模型供应商,意味着以后对外 API 会更强调调用审计、用途限制和反蒸馏护栏,开发者的自由度会和合规成本一起往上走;对跨境做 AI 的团队,意味着「调用海外模型做研发」这件事的合规边界会更紧,尤其是涉及商业化和再分发时;对国内实验室,则是一记提醒:能力差距在收窄,但合规叙事的主动权不在自己手里。
当然,这类报告要带着透镜看。Anthropic 既是受害方也是市场方,它用「我被人偷」来强化「我值得信任」,逻辑自洽但立场鲜明。数字可以引用,但别当成终审判决。更值得行业做的,是把「什么是合理蒸馏、什么是越界提取」的讨论从厂商单方面定义,推向更透明的行业准则——否则今天被点名的是这几家,明天标准怎么划,仍是巨头说了算。
长期看,这场拉扯会加速两件事:一是各家更快把能力收进自研闭环,减少对外模型的硬依赖;二是监管会更早把「前沿模型调用与再分发」纳入管理。对开发者而言,最稳妥的策略是:能自研就自研,要用就走合规授权,别把产品命脉系在随时可能收紧的接口上。
把这件事放到更长的 timeline 看,它其实在推动「蒸馏」从灰色地带走向明规则。过去行业对什么是合理微调、什么是越界提取,全靠各家自觉;当头部实验室开始用威胁情报的口吻点名,意味着行业迟早要坐下来谈标准——哪些调用算正常、哪些规模算滥用、跨国调用要不要报备。对国内做模型的团队,越早把合规框架搭在自己身上,越不用被动接别人的定义。短期看是舆论战,长期看是规则制定权的争夺,而这恰恰决定未来谁能自由地把模型卖向全球。
对中小实验室,这轮指控反而是差异化的窗口。与其在跑分上和巨头死磕,不如把「开放且合规」做成品牌——清楚标注数据来源、公开训练边界、接受第三方审计。在客户越来越在意供应链安全的当下,这种透明本身就是竞争力。信任是慢慢攒的,一次负责任的披露,比十次营销都有说服力。被点名的不该只是警醒,更该是行业自我规范的起点。







