Agent-Threat-Rule/agent-threat-rules

Open detection-rule standard for AI agent security threats — like Sigma, but for AI agents. Executable rules across 10 categories; merged into Microsoft AGT, Cisco AI Defense, MISP, OWASP, FINOS & SigmaHQ. MIT-licensed.

解決的問題

ATR(Agent Threat Rules)提供一種標準化、廠商中立的格式,用於檢測 AI 代理中的安全威脅。它彌補了高階風險分類(如 OWASP 或 MITRE ATLAS)與實際可部署的檢測規則之間的差距,解決代理基礎設施中的提示注入、工具污染與憑證外洩等漏洞。

工作原理

ATR 定義了一個版本化的 YAML 模式,用於撰寫檢測規則。每個規則指定要匹配的攻擊模式、要檢查的輸入欄位(如 LLM I/O 或工具呼叫參數),以及如何將發現結果映射回安全框架。

本專案提供一個基於 TypeScript 的參考引擎與 Python 包裝器(pyATR)來評估這些規則。它也包含一個 CLI 工具,可用於掃描檔案(如 SKILL.md 或 MCP 設定日誌),並支援將規則匯出為與 Splunk 和 Elasticsearch 等 SIEM 工具相容的格式。

適用對象

  • 安全工程師:用於在執行階段實作代理威脅的檢測與阻斷。
  • 代理框架開發者:用於將安全掃描嵌入代理執行時、代理或 IDE 延伸模組中。
  • 紅隊人員:可使用提供的技術目錄(ATD)測試代理安全性。
  • DevOps/CI 工程師:可透過 GitHub Actions 集成安全門禁。

主要亮點

  • 標準化格式:一種機器可讀、可同行審查的規則格式,類似 Sigma 或 YARA,但專為 AI 代理設計。
  • 多語言支援:提供 TypeScript 與 Python 的參考實作,並提出 Go 與 Rust 的合約。
  • 靈活執行:支援「車道」(enforce、alert、hunt)以平衡精確度與召回率,並提供可選的阻斷模式以限制代理行為。
  • 廣泛整合:已整合至 Microsoft、Cisco 和 OWASP 的工具中,並支援 SARIF 輸出以用於 GitHub 安全標籤。
  • 技術目錄:包含 Agentic Threat Detection (ATD) 目錄,將 80 種技術映射至 MITRE ATLAS 和 OWASP 的 9 個戰術。

相關

  • 專案
  • 專案
  • 專案
  • Dispatch
  • 專案