AI Pulse
📡 X 信号

Anthropic 给 Claude 加了藏在文字里的AI水印

🇪🇺 这是欧盟《人工智能法案》的直接后果 ⬇️

@AnthropicAI(Claude)正在部署一套给其人工智能生成内容打标记的系统。

👉 最有意思的部分和文本有关:这个标记不是那种删了就没的简单元数据或隐藏标签。标记会直接嵌入文本生成过程中,在模型层面完成。

大致来说,当 Claude 选择组成回复的单词/token时,它会插入一个读者无法感知的统计信号。在足够长的文本上,检测工具就可以搜索这个信号,判断内容是否大概率由 Claude 处理生成。

后果就是:哪怕你把内容复制粘贴到 Word、备忘录、网站或文本文件里,标记也不会消失,因为它就由文本本身承载。

但另一方面,大量重写、复述、翻译,或是和其他文本混合,就足以破坏信号,让它无法被检测出来。Anthropic 已经明确承认了这一点。

对于图片和部分文件(.PNG、.JPG、.SVG…),Claude 还会使用遵循 C2PA 标准的签名来源元数据。这些元数据可以用来验证文件是否由 Claude 处理过,并核查来源信息的完整性。

但要注意检测结果的含义:找到 Claude 的标记,并不证明内容就是 Claude 生成的。如果你自己写了一段文本,再让 Claude 帮你校对、翻译或改写,得到的版本也会被打上标记。

反过来,检测不到水印,也不能得出文本不是人工智能生成的结论。

Anthropic 是在履行欧盟 AI Act 相关承诺的框架下,计划为新模型部署这套系统。

该系统将适用于 Claude、API、Claude Code 以及其他使用兼容模型的服务,覆盖范围包括欧洲以外地区。

现在最值得关注的部分还没有公布:水印的技术文档、假阳性率、抗修改能力,最重要的是 Anthropic 将会开放给公众使用的检测工具。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新