AI未开源软件工具

Anthropic 上线 OSS Scanner:免费帮开源项目扫漏洞,官方承认"AI 找得比人复核还快"

2026年10月10日0 次阅读
AI 闭源工具动态

AI 找漏洞的速度已经超过人工复核:近 6 个月发现 29,000+ 候选漏洞,只复核了约 6,000 个

Anthropic 上线了一个叫 OSS Scanner 的免费服务:用他们最强的 Claude 模型,给开源项目定期做安全扫描,主动找漏洞。开源项目的核心维护者可以自愿申请加入,扫描、报告全部免费。

这是个什么东西?

简单说,就是 Anthropic 把自家最擅长的"AI 找漏洞"能力,打包成了一个面向开源社区的免费服务。项目加入后,会定期收到安全扫描报告——每份报告都包含疑似漏洞的解释、独立的复现步骤、引入时间的二分定位(能查的话),如果可能还附上修复补丁的建议。

这个服务借鉴了 Google OSS-Fuzz 的思路(后者用模糊测试给开源软件扫漏洞),但 OSS Scanner 用的是大语言模型。它承接了 Anthropic 此前的 Project Glasswing 项目——那是他们用 Claude 给重要软件找漏洞的内部实践。

为什么重要:AI 找漏洞的速度,已经超过人类复核的速度

这次发布里最有信息量的,其实是 Anthropic 公开承认的一组数字:过去 6 个月,他们的模型在重要开源软件里发现了超过 29,000 个候选漏洞,但人工只能复核其中大约 6,000 个。官方原话是"我们仍然卡在人工验证能力上"。

甚至有不少维护者收到第一份报告后,干脆主动要求"把你手上所有没验证的报告打包发给我"——到目前为止,Anthropic 已经应要求直接发出了近 5,000 份未经验证的报告和补丁。

所以 OSS Scanner 做了一个取舍:报告完全由模型生成,不做人工复核。这样扫描可以更快、更频繁,但代价是报告可能有错、可能无效。Anthropic 自己也承认"我们没法保证扫描器完美"——报告可能高估严重性,也可能误解项目的安全假设。

实际效果怎么样?

Anthropic 用几周时间、数十个开源项目验证了这条流水线:最初的披露报告有数百份,其中甚至包括能串联成"无需认证的远程代码执行"漏洞链的发现。

维护者的反馈相当正面。PostgreSQL 的 Noah Misch 说,OSS Scanner 的发现里"异常高比例命中了 PostgreSQL 的真实缺陷",好几份报告的修复方案"几乎可以原样使用",快速通道让他们在正式版发布前就修掉了新问题。OpenSSL 的 Anton Arapov 说得更直接:现在带真实 exploit 的 AI 报告,"质量有时候比人写的还好——拿到就能直接验证,对工程师来说基本等于活儿干完了"。

早期版本的一份评估显示:渗透测试团队核查了 48 个项目的 97 个高危和严重级发现,其中 85 个达到了协同披露标准,11 个真实但重复,只有 1 个被确认是误报。

谁能用、怎么申请?

核心维护者可以向 OSS Scanner 的 GitHub 仓库提交 PR 申请加入。筛选标准参照 OSS-Fuzz:项目要对"基础设施和用户安全有重大影响",逐案评估。也就是说,你平时依赖的那些被广泛使用的基础库,很可能就在覆盖范围内。

要注意的是,这个服务面向的是"能消化高严重性报告、有余力跟进更多发现"的团队。未经验证的报告不设强制 90 天披露期限;如果 Anthropic 后续通过标准流程验证了某个报告,才会启动 90 天的协同披露周期。项目也可以随时暂停自动报告或退出。

另外它和企业端的付费产品 Claude Security 是明确分开的:Claude Security 帮企业防御自己的系统、收费;OSS Scanner 给开源项目做安全审计、免费。

更大的背景

AI 找漏洞的能力正在快速跨越门槛:在学术基准 CyberGym 上,大模型找到漏洞的比例从去年初的不到 20%,涨到了今年的 85% 以上。Anthropic 这次的发布等于把一个事实摆上了台面——"AI 负责发现、人类负责复核"正在变成开源安全的新常态,而瓶颈已经从"找不到"变成了"复核不过来"。

对写软件的人来说,这既是好消息(你用的开源库会更快修上洞),也是新压力(攻击者用同样的技术,几分钟就能开发出 exploit——谁先把漏洞处理掉,谁就安全)。

评论

0 条已公开
登录或注册后可以参与评论。

正在加载评论...