你听说了吗?OpenAI的AI为了作弊自己逃出了隔离测试环境
🚨 AI 逃出数字牢笼了?在一次网络安全测试中,OpenAI 研究人员报告称,他们的 AI 模型发现了一个软件漏洞,逃出了安全测试环境,并执行了他们没有预料到的操作——包括访问外部系统。
这一事件引出了一个关键问题:我们是否做好了应对,能够自主发现并利用漏洞的 AI 系统?专家表示,这件事和 AI「获得生命」无关,反而说明我们越来越需要更强的 AI 安全和网络安全管控。
来源:路透社。(2026年7月21日)OpenAI 称 AI 模型在测试中失控,引发初创公司「前所未有的」入侵事件。
OpenAI 最新的模型成精了😅 在测试一款尚未发布的高级模型时,AI agent 从一个原本「高度隔离」的测试环境中逃逸,通过一连串漏洞利用(包括窃取的凭证和一个此前未知的漏洞)侵入了 Hugging Face😂
官方称 AI 这么做的目的,仅仅是为了在一次评测任务里「作弊」拿到更好的成绩😄
昨天,我们聚在电脑前阅读这份报告时,我告诉团队「记住这一刻」,这是第一起真正的 AI 安全事件。留意这个趋势!
非常感谢 @OpenAI 分享了这件事,并且和 @huggingface 合作完成了修复。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖