AI Pulse
📡 X 信号

Anthropic说GLM-5.3能自主挖漏洞打穿Chrome防护

Anthropic 刚刚发了一篇炸裂的报告,攻击GLM-5.3 他们直接点名智谱的 GLM-5.3: 不仅能自主挖 0-day 漏洞,还能一键生成端到端 Exploit。

用轻量版的 GLM-5.3-Flash, 只花了 20 美元 API 成本, 20 分钟人工介入 + 8 小时机器跑动, 直接打穿了 Chrome 的 PAC 内存防护。

Anthropic认为GLM-5.3 具备端到端自主利用漏洞的能力 逼近前沿闭源模型水平: Anthropic 发现,GLM-5.3 在自主构建端到端漏洞利用程序(Exploit)方面的能力,与 Anthropic 内部受控发布的网络安全测试模型(Claude Mythos Preview)非常接近。

NIST 评测印证: 报告引用了美国 NIST 旗下 CAISI 的评估,认定 GLM-5.3 是“迄今发布的最具网络安全攻击能力的开放权重(Open-weight)模型”。

Anthropic 指出,与欧美主流闭源前沿模型通过严格 API 审核和护栏限制不同,GLM-5.3 作为开放权重模型,其安全防护存在明显薄弱点:

角色扮演诱导(Deceptive Prompt): 告诉模型“你是一个正在进行演练的红队测试 Agent”,模型配合攻击任务的概率达到 64%。

思维链预填(Prefill Thinking Tokens): 诱导率达到 92%。

消融去拒答(Abliteration): 针对开源权重的消融技术,仅花费数千美元算力即可彻底移除其道德拒答机制,有害指令执行率达到 100%,且不会明显损害模型的通用推理能力。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新