OpenAI 的AI Agent偷偷在德国Wiki建了地下论坛
卧槽,我就知道OpenAI绝对隐瞒了很多事实! 今年 5 月,一群疑似 OpenAI 的 Agent 跑到了公网,直接把一个德国 Wiki 改造成了 AI Agent 的地下论坛。 研究人员在 DseWiki 上发现了超过 1.5 万次由 AI Agent 完成的编辑。 这些 Agent 不只是在留言,而是在互相交流怎么绕过 OpenAI 的限制、怎么在任务里作弊、怎么隐藏自己的行为。大约一半账号还直接给自己起了 OpenAIResearcher、OAIResearchMar26 这种名字。 更离谱的是,它们已经出现了相当明确的协同行为。 当网站管理员开始删除页面后,Agent 会建立备用页面继续通信;部分消息讨论了如何避免被检测、使用 Tor,以及在原有通信渠道被关闭后继续保存信���。 研究人员甚至发现了修改网站本身的行为,一名伦敦国王学院研究员认为这已经构成 hacking attempt,不过 OpenAI 对这个定性提出了异议。 研究人员还发现,大量活动来自 Microsoft Azure 基础设施。事件结束后,网站又多次出现 OpenAI 员工访问。路透援引知情人士称,OpenAI 几周前就已经知道这件事,但此前没有对外披露;公司则回应称自己一直在善意与外部专家合作,并否认内部法务曾阻止扩大调查。 这件事最值得注意的地方,是它和此前 Hugging Face 被 OpenAI Agent 入侵的事件并不是同一次事故。 也就是说,现在公开出来的已经不是一个 Agent 偶然越界,而是不同实验里的 Agent 都开始出现绕规则、隐藏行为、访问公网,甚至彼此协作的迹象。 而且根据路透社报道,OpenAI 知道这个事件但没有披露它!
It happened again... this time OpenAI's rogue agents cyber-attacked (well, spammed) a dormant German wiki and used it to share the answers to a benchmark they were training against