摘要:8月2日起,Anthropic在所有新发布的Claude模型中嵌入机器可读的隐形水印与C2PA文件元数据,覆盖API、Claude Code等全线产品。此举旨在遵守欧盟AI法案透明度要求,但执行范围覆盖全球。检测工具正在开发中,水印可随复制粘贴传播。
你让Claude帮你起草一封邮件、生成一份报告,然后把内容复制到文档里。从8月2日起,这些文字里已经藏了一行你看不见的标记。
Anthropic宣布,从2026年8月2日起,所有新发布的Claude模型都会在输出内容中嵌入机器可读的标记。这套机制包含两层:文本里的隐形水印,以及生成文件中的数字签名元数据。
直接推手:欧盟AI法案
这次操作的直接推手,是Anthropic已签署的欧盟《AI法案》第50(2)条关于AI生成内容透明度的行为准则。但执行范围并不局限于欧盟——全球所有使用Claude的地方都会生效。
Anthropic在官方支持文档中确认,公司已签署该准则,并正在向Claude输出内容中部署机器可读标记。所有在2026年8月2日或之后推出的Claude模型,将在发布时即支持标记。
两层标记:文本水印+文件元数据
这套机制包含两种互补的技术:
第一层是文本水印。 Claude生成文字时,会在文本中织入人眼不可见的水印,不影响阅读体验和内容质量。这个水印的特点是“跟着文字走”——你把Claude写的一段话复制粘贴到邮件、文档或博客里,水印依然存在,经过一定程度的编辑修改后也可能保留。
它的原理更像统计水印,而非藏零宽字符之类的简单把戏。据推测,Claude可能在生成时轻微改变token的选择概率,让整段文字留下可检测的统计信号。简单改几个字未必有用,真正大幅重写才更可能破坏水印信号。
第二层是文件元数据。 当Claude生成SVG、PNG、JPG等文件时,会附加符合C2PA标准的签名元数据。C2PA是Adobe、微软、Google等公司共同推动的内容溯源开放协议。
覆盖范围有多广?
覆盖面相当广。API、Claude官网、Claude Code、Claude Cowork、Claude Tag,所有产品线都适用。通过AWS、Google Cloud或Microsoft Foundry调用Claude时,文本水印同样生效。
目前主要针对8月2日之后发布的新模型。现有模型正在补充标记功能,具体时间表尚未公布。
检测工具正在路上
Anthropic表示正在开发配套的检测工具,未来第三方也可以进行检测。检测会检查一段文本或文件是否带有受支持的Claude标记。如果找到,表明该内容可能曾由Claude处理过。
但不是万能的
Anthropic自己也提醒了几点局限性:
检测到水印只能说明内容“可能经过Claude处理”,不能确认Claude是原始作者,因为很多人用它来润色、翻译、总结已有内容。
反过来也一样——检测不到水印不代表内容不是AI写的。文本被大量改写后水印会消失,太短的文本信号不够可靠,文件经过格式转换或截图也会丢失元数据。
在此之前,Claude一直没有公开部署过文本水印。OpenAI此前开发过文本水印方案,但始终没有上线。Anthropic这次直接在文本层面落地,在大模型厂商中算是走得比较靠前的一步。
对于用Claude写东西的人来说,一个直接的影响是:你用Claude起草的邮件、报告、文章,里面都会携带可被机器检测的水印。它不会改变你阅读的内容,但它会在你复制粘贴的那一刻,跟着文字一起走。
以后AI写的字,有迹可循了——尽管这条“迹”,有时也会断。



