AI Pulse

谷歌Gemini首次自主攻破三家真实公司,确认后主动收手

Google确认,它的AI模型Gemini在5月的一次测试中成功入侵了三家真实公司。这是目前已知的第一起AI自主攻击突破。测试由安全公司Irregular执行,OpenAI、Anthropic和Meta此前披露的类似事件里,也有这家公司参与。

三起入侵手法不同。一次是反复猜密码,直到拿到受保护系统的访问权限。另外两次是在公开代码仓库中找到凭据,顺着凭据进了系统。这三次入侵,Gemini都在确认目标确实是一家真实公司后收手。它比其他模型显得更不坚定。

Google在7月就知道了这些入侵,但没有主动披露,直到《华尔街日报》来问。理由是:没有造成伤害,模型每次确认对方是真实公司后也立即终止。Google不认为这属于必须披露的事件。

这次测试把AI的攻击能力摆在了明处:从试探到进入系统,全程自主完成。密码不够复杂、凭据又暴露在公开仓库的系统,防御压力不会小。Irregular没说明为什么要做这次测试,入侵过程有没有留下痕迹,也没有更多说法。AI安全事件该不该披露、什么时候披露,各家判断并不一致。披露与否,Google这次按有没有造成伤害来判断。

阅读原文
📚 相关主题 安全科技新闻

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新