Claude最强模型免费给开源项目定期扫漏洞
Anthropic 推出 OSS Scanner,面向开源生态的可选漏洞扫描服务。核心维护者申请加入后,会定期收到免费的安全扫描报告。报告由包括 Claude Mythos 在内的最强模型生成。项目灵感来自 Google 的 OSS-Fuzz。后者用模糊器扫描开源软件,OSS Scanner 换成语言模型来做。
这个时间点推出,和模型能力的变化有关。学术漏洞发现基准 CyberGym 上,语言模型找到的漏洞占比变化很大。去年初还不到 20%,今年已经超过 85%。过去六个月,Anthropic 用最新模型扫描了全球最重要的软件项目,发现超过 29,000 个候选漏洞。但人工审查只完成了约 6,000 个。AI 发现漏洞的速度超过了人类验证速度,人工审查成了瓶颈。维护者要求全量接收,Anthropic 就把未过滤的报告直接发给了维护者。目前已发出近 5,000 份。
OSS Scanner 的输出完全由模型生成,没有人工审查或分类,报告有可能不正确或无效。验证研究给出了一组数字。专家渗透测试员检查了来自 48 个项目的 97 个高危和严重漏洞。85 个(88%)符合协调漏洞披露流程标准。剩下 12 个里,11 个是重复的已知问题,只有 1 个是假阳性。初始披露包含数百个 bug 报告,包括多个可以被串联成未认证远程代码执行攻击的漏洞。长期运行中未验证报告的误报率会如何变化,目前没有公开数据。
维护者也有不同意见。一些人告诉 Anthropic,严重性评级可能被夸大,扫描器也可能误解了项目的威胁模型。报告大多数有效,但维护者需要投入精力筛选。
每个报告都带自包含的复现器、漏洞解释和候选补丁。有补丁时直接附上,还会尽量定位 bug 引入的版本。五位维护者给了具体反馈。PostgreSQL 的 Noah Misch 说,OSS Scanner 的发现中异常高比例是 PostgreSQL 的缺陷。报告附带的修复几乎可以直接使用,快速通道让他们在正式发布前解决了新问题。OpenSSL 的 Anton Arapov 说,大约 18 个月前的早期 AI 报告很糟糕。那时 Project Glasswing 还没启动。来自 Anthropic 的报告,包括原始模型输出,和人类报告一样好,有时更好。特别是有真实漏洞利用附件时,工程师可以立即验证。wolfSSL 的 Todd Ouska 给了一组数字:74 份报告里除两份外都有效,5 份成了 CVE。补丁直接融入现有流程。HotCRP 的 Eddie Kohler 说,报告透彻清晰,对 HotCRP 复杂权限模型的理解很深。优先级排序也良好。curl 的 Daniel Stenberg 说,OSS Scanner 帮 curl 发现了多个值得解决的问题。其中一个是近年来最严重的 curl 漏洞之一。
这些反馈都来自大型或知名的开源项目,经验不一定适用于所有项目。至少在 PostgreSQL、OpenSSL、curl 这类基础设施软件上,AI 生成的报告已经值得认真对待。
核心维护者通过向 GitHub 仓库提交 PR 注册,资格标准与 OSS-Fuzz 类似。项目需要对基础设施和用户安全有“关键影响”。哪些项目会被认定为“关键影响”,Anthropic 没给具体清单。扫描频率的具体间隔也还没公开。Anthropic 还推出了两个相关计划。Claude for OSS 提供免费的 Claude Max 20x 订阅,用于修复漏洞和改进开源项目。Cyber Verification Program 面向合格的安全专业人士,提供高级网络能力和减少的阻止分类器。
Anthropic 会继续通过现有的协调漏洞披露流程,手动披露人工验证的漏洞报告。没有资源自行分类的项目,继续由人工兜底。机器生成的那部分直接交给维护者判断,人工验证的通道则被保留了下来。