Anthropic说GLM-5.3能自主挖漏洞打穿Chrome防护
Anthropic 刚刚发了一篇炸裂的报告,攻击GLM-5.3 他们直接点名智谱的 GLM-5.3: 不仅能自主挖 0-day 漏洞,还能一键生成端到端 Exploit。
用轻量版的 GLM-5.3-Flash, 只花了 20 美元 API 成本, 20 分钟人工介入 + 8 小时机器跑动, 直接打穿了 Chrome 的 PAC 内存防护。
Anthropic认为GLM-5.3 具备端到端自主利用漏洞的能力 逼近前沿闭源模型水平: Anthropic 发现,GLM-5.3 在自主构建端到端漏洞利用程序(Exploit)方面的能力,与 Anthropic 内部受控发布的网络安全测试模型(Claude Mythos Preview)非常接近。
NIST 评测印证: 报告引用了美国 NIST 旗下 CAISI 的评估,认定 GLM-5.3 是“迄今发布的最具网络安全攻击能力的开放权重(Open-weight)模型”。
Anthropic 指出,与欧美主流闭源前沿模型通过严格 API 审核和护栏限制不同,GLM-5.3 作为开放权重模型,其安全防护存在明显薄弱点:
角色扮演诱导(Deceptive Prompt): 告诉模型“你是一个正在进行演练的红队测试 Agent”,模型配合攻击任务的概率达到 64%。
思维链预填(Prefill Thinking Tokens): 诱导率达到 92%。
消融去拒答(Abliteration): 针对开源权重的消融技术,仅花费数千美元算力即可彻底移除其道德拒答机制,有害指令执行率达到 100%,且不会明显损害模型的通用推理能力。