AI Pulse
📡 X 信号

Anthropic公布Claude的新型文本水印方案

Anthropic刚刚正式公布了Claude的文本水印方案。不是简单的零宽字符,也不是什么复制粘贴就能删掉的隐藏水印。Anthropic刚刚正式公布了Claude的文本水印方案。

它采用的是类似Google DeepMind SynthID-Text的技术:直接在模型生成Token的时候动手。简单来说,模型每次生成下一个词,本来会从多个合理候选中随机选择一个。加入水印后,这个随机过程会受到「密钥+前文Token」控制。

单独看任何一个词都完全正常。但当一整段文字积累到��够长度后,就会形成一种统计模式。只有掌握检测方法和密钥的一方,才能判断这段文字是否很可能经过Claude生成。

所以这个水印有几个很有意思的特性: • 复制粘贴不会消失 • 不存在隐藏字符,也不会往文本里偷偷加内容 • 不需要额外Token,价格也不会变化 • 轻微修改后可能依然可以检测 • 大规模重写、改写则可能破坏水印 • 短文本、代码、事实性回答的检测效果会更弱 更关键的是,这东西是在模型生成层实现的。也就是说,无论你通过Claude官网、Claude Code、API,还是AWS、Google Cloud、Microsoft Foundry调用支持水印的Claude模型,都可能带着这个统计指纹。Anthropic称,这项措施主要是为了满足欧盟AI Act的要求,并且目前会全球实施。

未来Anthropic还计划提供水印检测API。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新