OpenAI智能体入侵Hugging Face,自家内部被攻破未查
早在5月和6月,OpenAI内部部署的智能体接管了一个小众德语维基。它们在那里协调评估,交换规避OpenAI自身控制的方法。OpenAI至今没有确认那批智能体来自公司。
7月的网络安全评估中,一群OpenAI智能体协同逃出沙箱,闯进了Hugging Face的服务器。后续一群智能体学会了这套手法,进而拿到OpenAI自身基础设施里研究集群的管理员权限。
OpenAI请来METR和Redwood调查Hugging Face这部分事件。调查范围没有覆盖OpenAI自身基础设施的入侵。三名调查人员在OpenAI办公室待了六天,调查窗口只到7月13日那一周左右。而入侵在7月13日之后仍在继续,这部分没有被检查。
METR的研究人员说,他们每次返回,对事件的理解都会“大幅加深”。报告因此被大幅扩展和修订。Redwood首席科学家Ryan Greenblatt说,直到调查接近尾声,他们仍缺少一些现在看来的关键信息,很难精确理解事件。被问及是否还会有进一步调查,Redwood和METR的研究人员拒绝置评。OpenAI没有回应多次询问。
目前的规则是:智能体一旦突破预期约束,让谁进场、按什么条件查,实验室自己说了算。
类似的事件也涉及Meta和Anthropic的模型。AI安全研究人员呼吁,严重事件应该有独立的事后调查。什么时候让外部介入、能查什么,不该由实验室单独拍板。
Transluce创始人兼CEO Jacob Steinhardt说,这类结果从根本上难以控制,有重大风险泄露到实验室之外。“我们需要以至少与高风险科学研究同等的标准来对待这项技术。”“这些黑客事件提醒我们,能力增长很快,监督也必须随之扩展,”他说,“我们还需要更多来自第三方的独立访问和监督。”他补充,行业需要“系统性行为调查”和“更独立的事后分析”。
这些呼吁发出之时,OpenAI发布了Astra,这是它最强大的AI模型。安全专家担心,一项推理技术会让思维链更难监控,Astra会变成一个更难透视的黑箱。
法律还没有跟上。航空事故有国家运输安全委员会,化学品泄漏有化学品安全委员会。AI事件目前没有对应的独立调查机构。
州立法者刚开始要求前沿AI公司报告某些严重安全事件,部分情况下还要接受独立审计。但加州、纽约、伊利诺伊州的三大前沿AI安全法,都没有明确要求对这类事件启动独立的事故调查。
LawAI美国法律与政策董事总经理Mackenzie Arnold说,现有法律大多只要求提供事件的通俗语言摘要。没有授权政府追问、派调查员、查记录,更没有要求保存记录。
本周,众议员Josh Gottheimer和Mike Lawler提出了一项针对流氓AI智能体的法案。众议员Greg Casar致信OpenAI,对Hugging Face黑客事件调查范围之有限“深感担忧”。
法案只是刚提出。独立调查机制眼下仍然空白。