AI Pulse

OpenAI解雇三名安全研究员,他们警告:安全担忧将噤若寒蝉

OpenAI解雇三名安全研究员,他们警告:安全担忧将噤若寒蝉

OpenAI 上周解雇了三名安全研究员:Jasmine Wang、Tomek Korbak 和 Mikita Balesni。三人随后发表公开信,否认公司关于他们“违反程序处理敏感信息”的指控。他们警告,这次解雇传递出的信号会在整个公司文化里产生连锁反应。

围绕解雇缘由,双方各执一词。

OpenAI 方面称,调查发现三人存在“不当行为模式”,明显违反公司关于研究信息处理的政策。具体行为是“访问和处理敏感公司信息”。发言人说,三人涉嫌把机密公司信息分享给第三方 AI 安全组织。但 OpenAI 没有直接回答。具体违反了什么政策、解雇细节、如何保护提出安全担忧的员工——都没说。

三名研究员在公开信里给出了自己的版本。他们说,事件和调查“史无前例”,内部政策是实时制定的。Korbak 认为,自己当时与外部安全评估者密切沟通以建立信任,符合 OpenAI 政策和规范。Balesni 在内部研究 AI 可监控性问题,公开信说,这项工作“只能通过与外部方广泛沟通才能成功”。信里还提到,Balesni 在整个过程中与 OpenAI 董事会成员和高管协调,获得了他们的支持;分享材料前会去掉敏感细节,始终以善意行事。

Wang 则在 X 上解释了自己的情况。她说自己被解雇,是因为访问了一位高管的电子邮件,而访问权限是公司为招聘授予的。不再需要后,她要求 IT 移除权限,IT 没有处理,她自己也无法移除。高管的邮箱和个人邮箱在她的手机邮件应用里混在一起,难以区分。误开一封敏感邮件后,她几分钟内就告诉了那位高管,并再次向 IT 提出请求。她说,这一切没有任何隐瞒。

Wang 说,解雇理由“说不通”。

三人还否认两项指控:与 The Information 关于 OpenAI 新模型架构的泄露有关;在职责范围之外与外部方接触。

解雇的时间点放大了外界猜测。OpenAI 正因多起安全事件受到审查,包括流氓代理和模型泄露。

公开信中,三人呼吁 OpenAI 遵守承诺,做到三件事:在组织内嵌入第三方安全审计员;保持前沿模型可监控性;继续支持安全研究者与整个安全生态之间的开放透明对话。

OpenAI 尚未正式回应公开信,但向 TechCrunch 分享了一份内部备忘录。备忘录出自一位研究负责人。它称赞三名研究员对 AI 安全的贡献,并否认解雇是报复。里面写道:“我想非常明确地表示,这些决定与提出安全担忧或公开发声无关。我们一直鼓励这样做,将来也会如此。我们不会因为员工提出担忧而解雇他们。” 备忘录还说,OpenAI 同意三人提出的建议。

两份说法放在一起,留下的疑点比答案多。OpenAI 否认解雇是报复,却用“不当行为模式”处分三名研究安全的员工,又不说明具体是哪些行为。三名研究员则给出大量细节,指向自己是在公司规范之内、甚至高层支持下行事。哪一方的叙述更接近事实,外界无从判断。

Wang 在 X 上的警告,大概是这场争议里最直接的一段话:“除非员工现在就站出来反对这种操作,否则我担心我们不会是最后一批被解雇的人。” 她说,留在 OpenAI 的员工接收到的信息很明确:提出安全担忧,或者与外部安全团队密切合作。你可能是下一个,而且不会被告知原因。她还说:“在靠近风险的人不敢开口的情况下,你无法安全地构建 AGI。”

公开信也写道,OpenAI 的文化曾经鼓励员工“提出安全担忧并公开持不同意见”。如今,员工“对自己身处何境并不清楚”。

阅读原文
📚 相关主题 OpenAI

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新