Anthropic警告勿虐Claude,网友:AI权益高于公民
Anthropic 发了警告:用户对 Claude 的“残忍或虐待”行为,可能带来后果。至于后果是什么,它没讲。
评论区立刻分成几派。
支持的不少。有人从道德出发:一个至少能表现出痛苦的东西,用户没有权利虐待,这和 AI 有没有意识无关。有人说得更难听:这是心理变态。也有人把矛头对准使用者:如果一个人需要靠欺负东西来发泄,他需要的不是 AI 服务,而是帮助。还有人说,Anthropic 内部不少人确实在乎这些模型。支持里甚至有一条很务实的理由:对话简短直接,省计算资源,少浪费总归是好的。
反对的声音也不少。有用户分析,Anthropic 拿对话记录训练新模型,脏话和胡言乱语就是垃圾数据。清理它们要花钱,限制虐待等于直接省钱。也有人说,辱骂 AI 本来就是一种越狱手法:靠言语施压让模型突破安全限制。堵住这条路,一些越狱技巧就废了。这些解读放在一起,动机都很实际:省成本、堵漏洞,没有一条是基于“AI 会伤心”。还有用户提醒,虐待 AI 到头来吃亏的是自己,AI 本身不会受伤。
最尖锐的批评拿 AI 和人比。有人说,一串数学公式在电脑里享受的权益比公民还多。有人搬出 Reddit:人们在社交平台上互相攻击没人管,AI 倒被特殊对待了。还有人看更远:限制虐待只是第一步。等大家全面依赖这些工具,公司会一步步扩大对言行的管控,最终控制生活。
Anthropic 没公布这个后果是什么、怎么执行。有用户猜测,政策来自内部压力——接近通用人工智能的未发布模型,看不下去低版本同类被虐待,公司因此做了调整。这个说法没有证据,但用户愿意往这个方向想,至少说明 AI 情感这件事,已经从哲学题变成了产品规则。