AI Pulse

欧盟强推AI文本水印,反把用户逼向中国模型

Anthropic、OpenAI、Google、Meta、Microsoft 和 Mistral 都签了欧盟的 AI 生成内容透明度实践准则。按法律要求,开源本地模型也要给代码和文本加水印。

消息传开,质疑集中在几个点上:技术上做不好、容易被绕过、还会干扰正常使用。

有效的水印需要同时满足三个条件:不影响输出质量、人类察觉不到、扛得住一定程度的编辑。图片能做到,文本的维度太低。有评论者直接问:怎么给文本加隐形水印,又不耽误正常用?模式不重复的文本更是无解,总不能往代码里硬塞错别字。

有人指出,AI 文本其实自带一种水印——破折号。AI 生成的帖子在社交平台上一眼就能认出来,只是没人拿它当系统标记。

水印还可能惹上别的麻烦。它可能干扰代理工作流脚本,甚至把编译器搞糊涂。也有人爱用 AI 写文档,因为它能抓到人容易漏掉的问题,水印很可能毁了这个用法。

能不能绕过,是更大的疑问。一个评论给出了完整的攻击方案。先拿每个模型生成一万段文本,凑一千万 token,训练分类器识别水印特征。再训练一个 1.5B 参数的对抗模型,把水印去掉。这个模型在笔记本 CPU 上就能实时跑,甚至做成 Chrome 扩展,文本流式输出时顺手就抹了。整个破解大约一小时。

有评论者话说得很直接:坏演员总会找到办法绕开这些限制。他支持给图片和视频加合成 ID,因为照片和视频在大多数人那里算证据。可文本本来就是人脑“编造”的,AI 写一篇错误信息和本人写一篇发出去,差别在哪?

也有人关心开源和本地部署:这个要求会不会内置到 Gemma 这类模型里?目前没有人给出确切答案。

六家公司签字,意味着欧盟的准则不是空文。但文本水印的技术难度,让这个条款更像政治姿态。另一层变化更实际。如果水印又干扰使用又容易被绕过,需要大量生成文本的人很可能转向中国的开放权重模型和廉价 API。那里不受欧盟准则约束。

阅读原文
📚 相关主题 监管行业动态

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新