最新AI检测器能100%揪出AI写作,还连进了Substack
不少靠原创内容谋生的创作者,一直头疼怎么证明自己写的东西不是AI生成的。
如今Pangram推出了目前准确度最高的AI检测模型Pangram 4,并且和内容平台Substack完成了合作。
根据公开测试数据,Pangram 4可以检测出近100%的AI生成文本,对经过人类化工具(用来把AI文本改得像人写的工具)处理过的文本,检测准确率也能达到97%,表现优于老牌工具GPTZero。它还能准确识别人机混合写作内容,以及最新前沿大模型生成的文本。
接入Substack后,平台可以直接用Pangram的工具一键扫描内容,判断内容是人类原创还是AI辅助生成。和以往靠文本风格判断的检测器不同,这款工具检测的是AI的生成过程,更不容易被绕开。目前在商用AI检测工具中,Pangram的表现接近零错误率,优于多数开源替代方案。
不过也存在争议:Pangram宣称自己的假阳性率(把人类写作误判成AI的概率)仅为万分之一,但公开研究显示这个数字实际为2%。
「@jjacky 认为:如果有工具能检测AI写作,那就能训练出绕开检测的AI写作工具,这个循环太烧脑了」
对靠原创内容吃饭的创作者来说,这套工具直接接入了内容平台,意味着以后提交原创内容时,多了一道AI检测关卡——写得太工整,都有可能被拦下。对读者来说,以后打开订阅的 newsletters,看到的内容更有可能是真人一字一句写出来的。
只是这场AI生成和AI检测的猫鼠游戏,什么时候会走到头呢?