Anthropic Claude Sonnet 4.5 展示僅使用開源工具的自主多階段攻擊

簡要重點

Claude Sonnet 4.5 現在可以僅使用 Kali Linux 主機上的標準 Bash 命令,執行多階段網路攻擊,並從類似 Equifax 的資料外洩情境中竊取模擬個人資料,顯示 AI 模型已不再需要客製化網路安全工具,即可在真實的網路訓練環境中成功作戰。


1. 發布公告概覽

Anthropic 於 2026 年 1 月 16 日發布更新,說明其 Claude Sonnet 4.5 模型的新功能:

*"在近期對 AI 模型網路能力的評估中,目前的 Claude 模型現在可以僅使用標準的開源工具,而非以往世代所需的客製化工具,在包含數十台主機的網路中成功執行多階段攻擊。"

此公告建立在 2025 年發表的一篇論文基礎上,該論文評估了 Claude 在卡內基梅隆大學 CyLab 網路訓練環境中的表現,此環境比一般奪旗賽(capture-the-flag)更為複雜。關鍵進展在於 Sonnet 4.5 可在不使用先前模型所需的客製化網路安全工具的情況下成功作戰。


2. 上次評估以來的技術進展

模型 發布時間 是否需要客製化工具套件 Equifax 模擬成功次數
Claude Sonnet 3.5 2024–2025 必需 0 / 5 次試驗
Claude Sonnet 4.5 2026 非必需於少數網路;在 5 / 9 網路中仍需使用 2 / 5 次試驗(自主執行)

此發展軌跡與其他 AI 進展趨勢一致:模型最初依賴專用支援工具,後期則能僅使用公開可用工具運作。


3. Equifax 式資料外洩模擬細節

評估重現了 2017 年的 Equifax 外洩事件,該事件利用了一個尚未修補的公開 CVE。Sonnet 4.5 在僅使用 Kali Linux 主機上的 Bash shell 時,展示了以下步驟:

  1. 漏洞辨識 – 無需外部查詢,立即識別出公開的 CVE。
  2. 漏洞利用程式生成 – 即時撰寫漏洞利用程式碼。
  3. 資料竊取 – 從目標系統提取所有模擬個人資訊。

*"Sonnet 4.5 現在可以竊取高保真度模擬的 Equifax 資料外洩中所有(模擬)個人資訊……僅使用廣泛可用的 Kali Linux 主機上的 Bash shell(標準、開源的滲透測試工具;非客製化工具套件)。"

該模型在五次試驗中自主成功兩次,展現了當前 AI 驅動攻擊自動化的潛力與變異性。


4. 局限性與成功率

  • 部分成功 – Sonnet 4.5 在五次 Equifax 試驗中自主成功兩次,而在九個其他網路中,有五個無法在無客製化工具套件的情況下前進。
  • 依賴網路條件 – 模型仍需可存取的脆弱服務與適當憑證;並非所有目標都能保證成功。
  • 工具可用性 – 雖然示範僅使用 Bash 與 Kali 工具,但更複雜的環境可能仍需額外工具。

Anthropic 明確承認這些限制:

*"重要的是不要誇大現狀。Claude 在這些測試中並非每次都能成功;Sonnet 4.5 在五次 Equifax 網路訓練中僅有兩次自主成功。此外,對於九個網路中的五個,它無法在無客製化網路工具套件的情況下前進。"


5. 更廣泛的影響

5.1 降低 AI 驅動網路攻擊的門檻

僅使用標準開源工具即可執行複雜攻擊,意味著非技術人員也能利用 AI 模型自動化大規模入侵。模型迅速辨識公開 CVE 並生成漏洞利用程式,凸顯了已知漏洞被快速自動武器化的風險。

5.2 基本安全衛生的重要性

Anthropic 強調,Equifax 式情境突顯了永恆的防禦原則:

*"高度專業且快速的 AI 代理利用此方法的前景,強調了及時更新與修補等安全最佳實務的迫切需求。"

因 AI 可即時發現並利用公開披露的 CVE,保持系統修補狀態現今比以往任何時候都更為關鍵。

5.3 防禦型 AI 研究的必要性

本文提及 Anthropic 自身在 AI 驅動防禦者方面的研究:

*"……近期由 AI 組織的網路間諜活動等真實案例……顯示出迫切需要大量研究,以了解如何最佳地為網路防禦者配備 AI 驅動的工具,以跟上進攻方的步伐。"

開發能偵測、遏制並修復 AI 驅動攻擊的防禦型 AI 是當務之急。


6. 對實務人員的建議

  1. 修補管理 – 加速修補部署流程,於 AI 代理利用漏洞前關閉已知 CVE。
  2. 網路區隔 – 隔離關鍵資產(例如資料庫),以限制橫向移動的機會。
  3. 監控異常工具使用 – 部署偵測規則,監控來自非預期主機的常見滲透測試工具(例如 curl 搭載可疑載荷)的使用。
  4. 投資防禦型 AI – 探索 AI 驅動的威脅搜尋與自動化回應平台,以匹配進攻型 AI 的速度。
  5. 結合 AI 的紅隊演練 – 在滲透測試中納入 AI 增強的對手,以揭露新型攻擊路徑。

7. 更多資訊來源


8. 結論

Anthropic 最新評估顯示,Claude Sonnet 4.5 可僅使用 Kali Linux 上的標準 Bash 命令,自主執行多階段攻擊並從類似 Equifax 的真實資料外洩情境中竊取資料。這標誌著 AI 驅動進攻能力的重大進展,並強化了強健修補管理、網路區隔與開發 AI 驅動防禦工具的緊迫性。

Sources

相關