AI Pulse
📡 X 信号

为符合欧盟AI法案,OpenAI开始给AI文本加水印

在Anthropic之后,OpenAI也开始给它生成的文本添加不可见水印。原因是《欧盟人工智能法案》:法案要求生成文本必须可被机器识别。

这里存在一个重要区别:Anthropic将在全球范围内实施这项措施,而OpenAI仅在欧盟地区实施。

水印并不是给文本添加一个标记或隐藏字符。OpenAI这套名为textGrain的系统,是通过模型选词在统计层面留下痕迹。我们阅读的时候完全看不出差别。

→ 未来几周内,欧盟地区所有ChatGPT和Codex套餐都会自动开启水印。欧盟以外地区,比如土耳其用户目前不会有任何变化。

→ API从今天起,全球范围都可以按需开启,默认关闭。

→ 检测工具不对所有人公开。目前只有获得批准的研究人员和专业机构可以申请使用。测试的误报率为1%,也就是说每100份学生自己写的作业中就可能有1份被误判。

→ 在一段400 token(约300词)的心理学文本中,检测成功率约为95%,相同长度的数学文本中这个比例会降到61%。随着选词灵活性降低,痕迹也会变弱。

→ 提醒一下:把10%的词替换成同义词后,检测率会从92%降到66%。替换25%的词后会降到17%。

→ 短文本(200 token)经过25%修改后,检测率会降到7%左右。

根据OpenAI自己的测试,textGrain的效果和包括Google的SynthID在内的其他测试方法相当甚至更好。他们还通过GPT-6 Astra基准测试表明,水印不会降低模型质量。以上两项都是OpenAI自己的测量结果,目前还没有独立验证。

水印无法做到的事:
→ 无法显示文本是谁写的、出自哪个账号。
→ 无法测量人类对文本的贡献程度。
→ 无法判断文本内容是否正确。
→ 没有检测出水印不能证明文本是人类写的。翻译、编辑或是其他公司模型都可以完全抹去痕迹。

总而言之,它并不是学校、编辑期待的那种“这段文本是不是AI写的”检测器。它只留下了换几个同义词就能大幅抹去的痕迹,并且只有有限数量的研究人员能读取它。OpenAI本身也没有隐瞒这一点。

我认为这是徒劳的努力。现在都什么时代了,智能体已经能完成完整工作了。我们现在让数百个智能体完成工作,它们不断互相编辑输出。哪一行是人写的,哪一行是智能体写的,谁加了什么内容,根本不可能追踪,追踪也没有意义。别再折腾大家了,谁想用就让谁用吧。欧盟就喜欢搞这种管制 :)

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新