AI Pulse

Claude给每句AI文字嵌入隐形水印,你永远看不见

Claude 现在在它生成的每一段文本里嵌入一个不可见的水印。每一句 Claude 写出来的文字,都带着一个永远看不到的签名。方案由 Anthropic 在模型层面实施。

水印有两种,都是机器可读的。文本水印藏在文字本身里,不改变含义、质量或可读性。文件水印针对 .svg、.png、.jpg 这类格式,用 C2PA 开放标准签署来源元数据。它还能检测文件有没有被人动过手脚。

覆盖所有出口

水印在模型层面生效,文本从哪儿来都躲不掉。API、Claude 界面、Claude Code、Cowork、Claude Tag,全在覆盖范围内。通过 AWS、Google Cloud 或 Microsoft Foundry 运行支持的模型,也一样带上水印。2026 年 8 月 2 日之后发布的模型,从第一天起就带水印;旧模型在过渡期内陆续覆盖。

这个做法一公布,评论区就分成了几派。

有人认为没有理由反对水印,反对的唯一原因就是想骗人。也有人觉得这事有点讽刺:Anthropic 在训练数据上大规模侵犯版权,之后又在输出里藏水印。

技术上,一条评论对照 Google 的 SynthID 文档,认为 Anthropic 可能用了类似思路。SynthID 通过微调语言模型的用词来嵌入水印。人几乎察觉不到,软件却能识别出足够清晰的模式。它对创意写作效果好,对事实性文本差一些。想移除它,等于用自己的话把整篇文本重写一遍。

疑问集中的场景

代码是第一个难点。语法严格,强行嵌水印可能影响质量;没有注释的代码受语法限制,很难藏进标记。有评论担心,只让 AI 修正语法错误的功能会因此失效。

翻译同样没有答案。一位评论者问:自己写了学术文本,让 AI 翻译一遍,水印会怎样?

能不能直接清除水印,评论区有人问了出来。有人猜纯文本可能用形似空格的特殊空白字符编码,随即想到会有程序专门清理这些空白。还有人开玩笑,让 Claude 写个 Python 脚本,把自己的水印移除。更实际的回答是:图像水印截图就能绕过,文本水印用自己的话重写一遍也就没了。重写本来就是使用 AI 内容时该做的事。

检测不是百分之百准确。有评论解释,Anthropic 这么做是欧盟 AI 法案的要求,其他组织也会跟进。水印机制接近捕捉个人的语气特征。快速拼写检查基本不受影响,短文本更难识别,写作风格接近 Claude 的人也可能会被误判。欧盟之外同样实施,多半是因为维护一个统一模型,比按地区区分更简单。

谁在推动

欧盟 AI 法案已经生效。有评论提醒做 AI 工作的人去了解这部法律。它还推荐了免费开源工具 provcheck.ai,用来标记自己的作品。

水印引出了新的问题。评论区追问:Anthropic 会不会借此主张版权?水印能不能防止 AI 训练被垃圾内容污染?

这轮讨论没有给出检测的误报率,也没有回答水印会不会被用来追踪用户。水印是机器可读的,它面向检测工具,肉眼看不见。AI 生成文字自带可追溯标记,正在成为 Claude 全线产品的默认配置。

阅读原文
📚 相关主题 生成式AI安全

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新