Anthropic 與 PNNL 人工智慧關鍵基礎設施防禦研究

Anthropic 與太平洋西北國家實驗室(PNNL)已證明,人工智慧可大幅加速識別關鍵基礎設施中的漏洞,將模擬攻擊者行為的時間從數週縮短至僅三小時。此概念驗證顯示,由人工智慧驅動的紅隊測試能幫助防禦者在攻擊者利用之前,及時修補關鍵系統(如水處理廠)的安全漏洞。

利用人工智慧加速攻擊者模擬

人工智慧模型可用於自動化攻擊者模擬——即針對網路模擬特定威脅行為或攻擊,以識別漏洞與檢測盲點。在實施防禦措施後,重複模擬攻擊,安全團隊可客觀評估這些調整的有效性。

為達成此目標,PNNL 為 Claude 開發了一個「架構」,可將自然語言提示轉換為複雜的攻擊鏈。該系統使用預先定義的基於程式碼的工具,使模型能更高效地在電腦網路上執行操作。

案例研究:水處理廠模擬

研究人員指派由 Claude 驅動的代理,模擬對高保真度的水處理廠網路物理模型的攻擊。此模擬由 PNNL 為美國國土安全部的網路安全與基礎設施安全局(CISA)運營的控制環境實驗室資源平台進行。

模擬的主要發現包括:

  • 效率提升:通常需人類專家數週完成的攻擊重建,僅在三小時內完成。
  • 模型靈活性:測試期間,當預設用於繞過 Windows 使用者帳戶控制(UAC)的工具失效時,Claude 展現出適應能力,識別並實施另一種已知的 UAC 繞過技術,以達成目標。

此模擬於 2025 年夏季使用 Claude Sonnet 4 進行。Anthropic 指出,隨著模型能力持續演進,這種靈活性與創造力預期將進一步提升,對攻擊者與防禦者皆有益處。

公私合作在國家安全中的角色

防禦關鍵基礎設施需要前沿人工智慧智慧與專業的實體測試環境相結合。Anthropic 與 PNNL 的合作展現出一種互補關係:雙方無法獨立完成此項實驗——Anthropic 提供模型智慧,PNNL 提供網路物理資產與領域專業知識。

此專案是更廣泛策略的一部分,旨在將人工智慧應用於網路防禦與國家安全。其他相關合作包括:

  • 核安保:與國家核安全管理局合作,開發針對人工智慧相關核風險的評估與緩解措施。
  • 起源任務(The Genesis Mission):美國能源部(DOE)主導的計畫,結合前沿人工智慧公司與國家實驗室,以實現國家安全領域的科學突破。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch