Project Glasswing: Anthropic 关于 AI 驱动漏洞发现的初步更新

TL;DR

Anthropic 推出了 Project Glasswing,这是一个使用 Claude Mythos Preview 模型来保护关键软件基础设施的协作计划。在第一个月内,该项目及其合作伙伴识别出了超过 10,000 个高危或严重级别的漏洞,这表明 AI 现在发现漏洞的速度已经远远超过了人类验证和修复它们的能力。

Claude Mythos Preview 的性能表现

Claude Mythos Preview 在自主网络安全能力方面展示了重大飞跃,使合作伙伴能够以通常超过其先前能力十倍的速度发现漏洞。

合作伙伴与外部验证

  • 总体影响: 大约 50 个合作伙伴共同发现了超过 10,000 个高危或严重级别的漏洞。
  • Cloudflare: 报告称在关键路径系统中发现了 2,000 个漏洞(其中 400 个为高危或严重级别),并指出其误报率优于人类测试人员。
  • UK AI Security Institute: 确认 Mythos Preview 是第一个端到端解决其两个网络靶场(多步网络攻击模拟)的模型。
  • Mozilla: 在 Firefox 150 中识别并修复了 271 个漏洞,与 Claude Opus 4.6 在 Firefox 148 中的发现结果相比,增加了十倍。
  • Benchmarks: 该模型在 ExploitBench 和 ExploitGym 学术基准测试中表现最强,并在 XBOW 的 Web 漏洞利用基准测试中展示了“前所未有的精确度”。

现实世界应用

除了代码库扫描,Mythos Preview 还被一家合作伙伴银行用于检测并防止了一起由于电子邮件账户被盗和伪造电话导致的 150 万美元欺诈性电汇。

开源软件扫描结果

Anthropic 使用 Mythos Preview 扫描了超过 1,000 个开源项目。该模型估计识别出了总计 23,019 个漏洞,其中包括估计为 6,202 个高危或严重级别的漏洞。

验证与准确性

为了验证这些发现,六家独立的安全研究公司和 Anthropic 对 1,752 个高危或严重级别漏洞的子集进行了评估。结果显示:

  • 真阳性率: 90.6% (1,587) 是有效的漏洞。
  • 严重程度确认: 62.4% (1,094) 被确认为高危或严重级别。

案例研究:wolfSSL

Mythos Preview 在 wolfSSL 加密库中检测到一个漏洞 (CVE-2026-5194),该漏洞本可以允许攻击者伪造证书以针对银行或电子邮件提供商托管虚假网站。 该漏洞现已得到修复。

“修复瓶颈”与系统性风险

Project Glasswing 揭示了网络安全的主要约束不再是漏洞的发现,而是人类在分级、报告和部署补丁的能力。

修复缺口

虽然 AI 可以几乎瞬间发现漏洞,但行业标准的协同漏洞披露 (CVD) 政策通常涉及 90 天的补丁窗口期。这造成了一个危险的中间期,即漏洞对 AI(以及潜在的攻击者)是已知的,但用户尚未修复。

对维护者的影响

开源维护者目前正处于超负荷状态。许多人报告称,由于“大量低质量、AI 生成的漏洞报告”而导致能力受限,这使得一些人请求 Anthropic 放慢披露速度。

网络防御者的适应策略

随着 Mythos 级模型的广泛普及,Anthropic 建议开发者和网络防御者转变其策略以减少风险暴露。

对开发者的建议

  • 缩短补丁周期: 加速从漏洞发现到安全修复可用之间的间隔时间。
  • 提高更新 UX: 让终端用户更容易安装更新,并在通知运行漏洞软件的用户时更加持久。

对网络防御者的建议

  • 加速部署: 缩短测试和部署补丁的时间线。
  • 实施分层控制: 依靠 NIST 和 NCSC 框架来强化默认配置,强制执行多因素身份验证 (MFA),并维护全面的日志记录。

新的防御性工具与计划

Anthropic 正在发布若干工具,以帮助组织在不需要 Mythos Preview 模型的受限能力的情况下,利用 AI 进行防御。

Claude Security and Verification

  • Claude Security (Public Beta): 适用于 Claude Enterprise 客户,该工具使用 Claude Opus 4.7 扫描代码库并提出修复方案。它已在三周内用于修复了超过 2,100 个漏洞。
  • Cyber Verification Program: 允许安全专业人员出于合法的研究、渗透测试和红队测试目的使用模型,而无需某些滥用防护措施。

技术资源库(面向安全团队)

符合条件的客户现在可以请求 Project Glasswing 合作伙伴所使用的工具套件,包括:

  • Custom Skills: 用于重复性安全任务的指令。
  • Scanning Harness: 一个用于映射代码库、部署扫描子代理并编写报告的系统。
  • Threat Model Builder: 一个通过映射潜在攻击目标来优先排序模型工作的工具。

未来展望与模型发布

Anthropic 尚未向公众发布 Mythos 级模型,因为目前的防护措施不足以防止严重的滥用。Project Glasswing 作为一个主动的努力,旨在在这些能力广泛普及之前强化关键软件基础设施。

在未来,Anthropic 打算将 Project Glasswing 扩展到更多合作伙伴,包括美国及其盟友政府,并向用户发布 Mythos 级模型,前提是必须开发出显著更强的防护措施。

Sources

相关