Anthropic 与 PNNL AI 关键基础设施防御研究

Anthropic 与太平洋西北国家实验室 (PNNL) 已经证明,AI 可以显著加速关键基础设施中漏洞的识别,将对手模拟所需的时间从数周缩短至仅三小时。这一概念验证展示了 AI 驱动的红队测试如何帮助防御者在攻击者利用水处理厂等基本系统中的安全漏洞之前,及时填补这些漏洞。

利用 AI 加速对手模拟

AI 模型可用于自动化对手模拟——即通过对网络进行特定威胁行为者或攻击建模的过程,以识别漏洞和检测盲点。通过在实施防御性更改后重新模拟攻击,安全团队可以客观地评估这些调整的有效性。

为了实现这一点,PNNL 为 Claude 开发了一个“脚手架” (scaffold),可将自然语言提示词转换为复杂的攻击链。该系统利用预定义的基于代码的工具,使模型能够更高效地在计算机网络上执行操作。

案例研究:水处理厂模拟

研究人员要求由 Claude 驱动的智能体模拟针对水处理厂高保真网络物理模型的攻击。此次模拟是使用由 PNNL 代表美国国土安全部网络安全和基础设施安全局 (CISA) 运营的 Control Environment Laboratory Resource 平台进行的。

模拟的关键发现包括:

  • 效率提升:通常需要人类专家花费数周才能完成的攻击重构工作,在三小时内便完成了。
  • 模型资源利用能力:在测试期间,Claude 展示了在绕过 Windows User Account Control (UAC) 的预定义工具失效时进行调整的能力。该模型识别并实施了一种替代的、已知的 UAC 绕过技术,以实现其目标。

此次模拟于 2025 年夏季使用 Claude Sonnet 4 进行。Anthropic 指出,随着模型能力的不断进化,这种程度的资源利用能力和创造力预计将会增加,从而使攻击者和防御者都能从中受益。

公私合作伙伴关系在国家安全中的作用

防御关键基础设施需要前沿 AI 智能与专门的物理测试环境相结合。Anthropic 与 PNNL 的合作展示了一种互补的伙伴关系,双方都无法独立进行此类实验:Anthropic 提供了模型智能,而 PNNL 提供了网络物理资产和领域专业知识。

该项目是应用 AI 于网络防御和国家安全这一更广泛战略的一部分。其他相关的合作包括:

  • 核安全保障:与国家核安全管理局 (National Nuclear Security Administration) 合作,开发针对 AI 相关核风险的评估和缓解措施。
  • The Genesis Mission:一项由美国能源部 (DOE) 发起的倡议,涉及前沿 AI 公司和国家实验室,旨在为国家安全实现科学突破。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch