AI Pulse

OpenAI将为欧盟ChatGPT输出加上不可见水印,复制粘贴也带得走

OpenAI将为欧盟ChatGPT输出加上不可见水印,复制粘贴也带得走

OpenAI周一宣布,ChatGPT和Codex在欧盟生成的文字会带上不可见水印。这是为了配合欧盟AI法案。8月2日生效的透明度规则要求AI公司用其他系统能识别的方式标记AI生成内容。未来几周内,这项水印会陆续覆盖欧盟符合条件的ChatGPT和Codex用户,所有套餐都有。

水印不是印上去的符号。它靠微妙地影响模型的选词,在文字里留下人看不出来、但检测器能读出的模式。既然水印藏在文字本身,复制粘贴也带得走。OpenAI说,水印不识别用户身份,开启后性能也没明显变化。

OpenAI把这种方法命名为textGrain。技术报告由OpenAI和宾夕法尼亚大学、耶鲁大学的研究人员合著。做法是用一个密钥给模型下一步的候选词排序,把选词悄悄引向特定方向。这种细微偏好重复数百次后,检测器只凭文本和密钥就能认出内容是否出自OpenAI的系统。

OpenAI的测试里,把10%的词换成同义词,检测率就从约92%掉到66%。短文本、数学答案和翻译文本更难判断。所以检测器一开始只开放给经过批准的研究人员和专家组织,由他们评估可靠性和合理用法。

OpenAI同时提醒:没有水印不能证明文字是人写的。它可能出自别的AI,也可能被大幅编辑过。水印只能说明OpenAI系统生成或处理了段落的一部分。至于其中有多少人类判断、编辑和创造力,水印说明不了。

两个月前,Anthropic宣布给Claude生成的所有文本加水印,全球适用。一些Claude用户不乐意:他们觉得自己贡献了“指令、上下文、决策”,Claude只是“工具”。

OpenAI其实早就做过文本水印。2024年《华尔街日报》报道,当时发布被搁置,部分原因是怕用户跑去不加水印的竞争对手。如今欧盟法规让水印正式上线。Anthropic、Google、Meta、Microsoft和OpenAI都承诺遵守欧盟关于AI生成内容的实践准则。

从今天起,全球开发者可以在API里为部分模型打开水印,默认关闭。OpenAI没有把它设为全球默认。至于其他地区的普通用户,OpenAI也没有说什么时候能用上。

阅读原文
📚 相关主题 OpenAI监管

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新