网络安全领域的 AI 军备竞赛:分析 Anthropic 的 Project Glasswing
大语言模型 (LLMs) 与网络安全之间的交集已达到一个关键的转折点。随着 Project Glasswing 扩展计划的宣布,Anthropic 不仅仅是在定位自己为一家 AI 提供商,更是在努力保护全球最关键软件的过程中扮演核心协调者的角色。通过向一组精选的组织授予 "Claude Mythos Preview" 的访问权限,Anthropic 旨在主动识别并修复漏洞,以防止其被恶意攻击者利用。
这一举措代表了行业在漏洞管理方式上的战略转变——从被动修补转向 AI 加速的防御态势。
然而,该计划的推出在安全专业人员和行业观察者中引发了重大辩论,主要围绕这些工具的实际效能以及中心化 AI 安全带来的地缘政治影响。
Project Glasswing 的范围
Project Glasswing 是一项旨在保护关键基础设施的协作努力。该计划最初由 50 个合作伙伴启动,目前 Anthropic 正在将其扩展到分布在 15 个以上国家的约 150 个新组织。此次扩展针对的是一旦遭受成功网络攻击可能导致灾难性后果的领域,包括:
- 关键基础设施: 电力、水务和通信。
- 公共卫生: 医疗保健系统。
- 供应链: 硬件供应商以及维护广泛依赖的代码库的非营利组织。
根据 Anthropic 的说法,使用 Claude Mythos Preview 的首批合作伙伴已经识别出了超过 10,000 个高危或严重级别的安全缺陷。
其长期目标是将行业的关注点从仅仅发现漏洞,转向自动化披露、修复以及已修复软件的部署。
"Mythos-Class" 威胁模型
Project Glasswing 的核心是 "Mythos-class" 模型概念。Anthropic 警告称,在 6 到 12 个月内,多家 AI 公司可能会推出功能强大的网络能力模型,其中一些可能缺乏防止滥用的安全防护措施。
在这种预期的未来中,网络攻击的数量和不可预测性可能会呈指数级增长。Anthropic 认为,网络防御者必须现在就做出调整,以跟上潜在攻击者的步伐。为了实现这一点,他们推出了 Claude Security,这是一款利用 Claude Opus 4.8 来扫描代码库并建议补丁的产品,同时将更强大的 Mythos 能力保留给在严格安全要求下的受信任合作伙伴。
行业质疑与 "噪声" 问题
虽然官方叙述强调了安全领域的突破,但社区的反应——特别是在 Hacker News 等平台上——揭示了更为细致且怀疑的态度。一个反复出现的主题是 "噪声" 和误报问题。
一位从业者分享了在企业环境中应用该工具的第一手经验,指出它经常会让团队陷入无关的警报中:
"对于我们来说,它绝对让我们淹没在噪声中……数百甚至数千个误报、轻微问题或不适用的问题……它造成最大的问题是,高管们把它产生的每一个问题都当成是必须放下手头工作去立即修复的紧急情况。"
这凸显了 AI 驱动安全中的一个系统性风险:模型识别潜在漏洞的能力与人类判断该漏洞在特定生产环境中是否真正可利用之间的差距。当高管将 AI 生成的列表误认为具有行动价值的智能情报时,可能会导致 "安全演习" (security theater) 现象,即团队在修复非问题时耗费了关键资源,却错漏了真正的威胁。
地缘政治与战略担忧
除了技术效能之外,Project Glasswing 的扩展还引发了关于信任和数据主权的重大担忧。由于该计划涉及向一家美国 AI 公司授予访问各种国家关键基础设施源代码的权限,批评者提出了关于监控和知识产权的问题。
一些观察者认为,该计划可能在无意中充当国家级情报收集的渠道,担心提供给中心化实体的敏感代码库可能会被政府机构审计。其他人则认为,Mythos 的有限且受限的发布是一种 "稀缺性策略",或者是旨在通过制造热度并在利润丰厚的安全市场中获取高价值企业合同的营销策略。
通往内存安全之路
尽管存在质疑,但 AI 促进大规模架构转变的潜力是一个真正令人感兴趣的点。其中一个最受期待的应用是使用 AI agent 来重构旧有的代码库,将其转换为像 Rust 这样的内存安全语言。
这种方法解决了许多关键漏洞(如缓冲区溢出)的根源问题,而不是在单个漏洞上进行永无止境的 "打地鼠" 式的修复。利用 AI agent 将常见的 Web 基础设施(如 Redis 或 Lua)迁移到 Rust 的尝试表明,未来 AI 不仅能发现漏洞,还能通过重写软件本身的底层基础来消除整类漏洞。
结论:防御者的永久优势?
Anthropic 的雄心是创造一种 "防御者的永久优势"。这是否能够实现,取决于 AI 是否能超越仅仅标记漏洞,转而能够可靠地自动化验证和修复过程,且不引入新的漏洞。如果行业能够解决信噪比问题并建立透明、无需信任的框架来进行代码分析,AI 确实可以保护全球软件供应链。如果不能,它则面临着成为一种高成本工具的风险,这会产生比实际安全带来的更多焦虑,而非真正的安全。