AI Pulse
📡 X 信号

博主质疑 Anthropic AI安全叙事的傲慢逻辑

Anthropic 最让我反感的一点,是它真的觉得只要自己认为是在做好事,就可以替用户做很多决定。

它刚发了一份 154 页的 Threat Intelligence Report,里面整理了 Claude 被用于网络攻击、诈骗、生物研究、武器开发、模型蒸馏等案例。

这些案例是怎么来的? Anthropic 会看用户怎么使用 Claude,发现它认为有问题的账号之后继续调查,分析这些人的使用方式,然后判断这个用户有没有越线。觉得有风险,就封号。之后再把这些事情整理成报告,对外解释它发现了什么、阻止了什么。

而且这种事情 Anthropic 已经做过很多次了。它会拿真实用户和 Claude 的对话去研究人到底在和 AI 聊什么,人怎么依赖 AI,人的价值观是什么,人在什么情况下会产生某种情绪。

它会告诉你,数据已经做过隐私处理,这些研究也是为了让 AI 更安全。

但我觉得这恰恰很傲慢。

为什么只要你说一句「为了 AI 安全」,你就可以去看用户在做什么? 为什么你觉得这件事值得研究,用户的数据就可以被拿去研究?

如果它觉得某种投资行为风险很高,某种政治讨论可能造成伤害,某种成人内容不符合它的原则,某种 AI 研究太危险,它是不是一样可以看、可以限制、可以封?

按照 Anthropic 现在这套逻辑,当然可以。 因为它一直默认了一件事: Anthropic 比用户更知道什么事情应该做,什么事情不应该做。

这也是为什么我一直不信 Anthropic 那套 AI Safety 叙事。

一个天天说自己担心 AI 替人类做决定的公司,自己却已经越来越习惯替用户做决定了。太老登了,老登是注定要被打败的。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新