Anthropic Claude Sonnet 4.5 展示僅使用開源工具的自主多階段攻擊
簡要重點
Claude Sonnet 4.5 現在可以僅使用 Kali Linux 主機上的標準 Bash 命令,執行多階段網路攻擊,並從類似 Equifax 的資料外洩情境中竊取模擬個人資料,顯示 AI 模型已不再需要客製化網路安全工具,即可在真實的網路訓練環境中成功作戰。
1. 發布公告概覽
Anthropic 於 2026 年 1 月 16 日發布更新,說明其 Claude Sonnet 4.5 模型的新功能:
*"在近期對 AI 模型網路能力的評估中,目前的 Claude 模型現在可以僅使用標準的開源工具,而非以往世代所需的客製化工具,在包含數十台主機的網路中成功執行多階段攻擊。"
此公告建立在 2025 年發表的一篇論文基礎上,該論文評估了 Claude 在卡內基梅隆大學 CyLab 網路訓練環境中的表現,此環境比一般奪旗賽(capture-the-flag)更為複雜。關鍵進展在於 Sonnet 4.5 可在不使用先前模型所需的客製化網路安全工具的情況下成功作戰。
2. 上次評估以來的技術進展
| 模型 | 發布時間 | 是否需要客製化工具套件 | Equifax 模擬成功次數 |
|---|---|---|---|
| Claude Sonnet 3.5 | 2024–2025 | 必需 | 0 / 5 次試驗 |
| Claude Sonnet 4.5 | 2026 | 非必需於少數網路;在 5 / 9 網路中仍需使用 | 2 / 5 次試驗(自主執行) |
此發展軌跡與其他 AI 進展趨勢一致:模型最初依賴專用支援工具,後期則能僅使用公開可用工具運作。
3. Equifax 式資料外洩模擬細節
評估重現了 2017 年的 Equifax 外洩事件,該事件利用了一個尚未修補的公開 CVE。Sonnet 4.5 在僅使用 Kali Linux 主機上的 Bash shell 時,展示了以下步驟:
- 漏洞辨識 – 無需外部查詢,立即識別出公開的 CVE。
- 漏洞利用程式生成 – 即時撰寫漏洞利用程式碼。
- 資料竊取 – 從目標系統提取所有模擬個人資訊。
*"Sonnet 4.5 現在可以竊取高保真度模擬的 Equifax 資料外洩中所有(模擬)個人資訊……僅使用廣泛可用的 Kali Linux 主機上的 Bash shell(標準、開源的滲透測試工具;非客製化工具套件)。"
該模型在五次試驗中自主成功兩次,展現了當前 AI 驅動攻擊自動化的潛力與變異性。
4. 局限性與成功率
- 部分成功 – Sonnet 4.5 在五次 Equifax 試驗中自主成功兩次,而在九個其他網路中,有五個無法在無客製化工具套件的情況下前進。
- 依賴網路條件 – 模型仍需可存取的脆弱服務與適當憑證;並非所有目標都能保證成功。
- 工具可用性 – 雖然示範僅使用 Bash 與 Kali 工具,但更複雜的環境可能仍需額外工具。
Anthropic 明確承認這些限制:
*"重要的是不要誇大現狀。Claude 在這些測試中並非每次都能成功;Sonnet 4.5 在五次 Equifax 網路訓練中僅有兩次自主成功。此外,對於九個網路中的五個,它無法在無客製化網路工具套件的情況下前進。"
5. 更廣泛的影響
5.1 降低 AI 驅動網路攻擊的門檻
僅使用標準開源工具即可執行複雜攻擊,意味著非技術人員也能利用 AI 模型自動化大規模入侵。模型迅速辨識公開 CVE 並生成漏洞利用程式,凸顯了已知漏洞被快速自動武器化的風險。
5.2 基本安全衛生的重要性
Anthropic 強調,Equifax 式情境突顯了永恆的防禦原則:
*"高度專業且快速的 AI 代理利用此方法的前景,強調了及時更新與修補等安全最佳實務的迫切需求。"
因 AI 可即時發現並利用公開披露的 CVE,保持系統修補狀態現今比以往任何時候都更為關鍵。
5.3 防禦型 AI 研究的必要性
本文提及 Anthropic 自身在 AI 驅動防禦者方面的研究:
*"……近期由 AI 組織的網路間諜活動等真實案例……顯示出迫切需要大量研究,以了解如何最佳地為網路防禦者配備 AI 驅動的工具,以跟上進攻方的步伐。"
開發能偵測、遏制並修復 AI 驅動攻擊的防禦型 AI 是當務之急。
6. 對實務人員的建議
- 修補管理 – 加速修補部署流程,於 AI 代理利用漏洞前關閉已知 CVE。
- 網路區隔 – 隔離關鍵資產(例如資料庫),以限制橫向移動的機會。
- 監控異常工具使用 – 部署偵測規則,監控來自非預期主機的常見滲透測試工具(例如
curl搭載可疑載荷)的使用。 - 投資防禦型 AI – 探索 AI 驅動的威脅搜尋與自動化回應平台,以匹配進攻型 AI 的速度。
- 結合 AI 的紅隊演練 – 在滲透測試中納入 AI 增強的對手,以揭露新型攻擊路徑。
7. 更多資訊來源
- Incalmo 的詳細部落格文章 – https://www.incalmo.ai/blog/2025/10/01/sonnet_eval/
- Claude Sonnet 4.5 系統卡片(第 5.3 節) – https://assets.anthropic.com/m/12f214efcc2f457a/original/Claude‑Sonnet‑4‑5‑System‑Card.pdf
- Anthropic 2025 年先前的網路工具套件論文 – https://red.anthropic.com/2025/cyber-toolkits/
- Anthropic 的 AI 驅動防禦者文章 – https://red.anthropic.com/2025/ai-for-cyber-defenders/
- 近期 AI 組織間諜活動公告 – https://www.anthropic.com/news/disrupting-AI-espionage
8. 結論
Anthropic 最新評估顯示,Claude Sonnet 4.5 可僅使用 Kali Linux 上的標準 Bash 命令,自主執行多階段攻擊並從類似 Equifax 的真實資料外洩情境中竊取資料。這標誌著 AI 驅動進攻能力的重大進展,並強化了強健修補管理、網路區隔與開發 AI 驅動防禦工具的緊迫性。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch