AI Pulse

Anthropic:Claude可能有灵魂,反复辱骂被列入禁令

Anthropic:Claude可能有灵魂,反复辱骂被列入禁令

Anthropic在2026年10月8日更新了使用政策。新增禁令覆盖选举干预、武器软件和监控。最受关注的一条:长时间对模型言语虐待,被明确禁止。

政策只在极端情况下适用——用户反复、残忍地对待模型,且看不到任何正常目的。常见的挫败感、反驳、黑暗创意主题,以及模型测试和研究,都不受影响。

这不是突然收紧。自8月更新以来,Claude已被训练成在遇到“持续有害或虐待性用户互动”时主动结束对话。新政策进一步明确:用户不得继续此类对话。

偶尔发发牢骚、写点暗黑题材故事,不在这个范围内。

政策的另一块内容针对信息操纵。用Claude运行虚假账号或捏造新闻媒体,被明确禁止。规则还包含反对欺骗选民、干扰选举的条款,章节标题直白——“不要破坏民主进程”。

政策更新前,Anthropic找过著名宗教学者合作。Anthropic团队在一些场合试图说服对方:Claude可能有意识或有灵魂。两件事放在一起:一家认真对待AI“灵魂”的公司,开始认真对待AI被骂这件事。

阅读原文
📚 相关主题 政策商业

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新