Agent-Threat-Rule/agent-threat-rules
Open detection-rule standard for AI agent security threats — like Sigma, but for AI agents. Executable rules across 10 categories; merged into Microsoft AGT, Cisco AI Defense, MISP, OWASP, FINOS & SigmaHQ. MIT-licensed.
解决的问题
ATR(Agent Threat Rules)为检测 AI 代理中的安全威胁提供了一种标准化、厂商中立的格式。它填补了高阶风险分类(如 OWASP 或 MITRE ATLAS)与实际可部署的检测规则之间的空白,解决了代理基础设施中的提示注入、工具污染和凭证外泄等漏洞。
工作原理
ATR 定义了一个版本化的 YAML 模式,用于编写检测规则。每个规则指定要匹配的攻击模式、要检查的输入字段(如 LLM I/O 或工具调用参数),以及如何将发现结果映射回安全框架。
该项目提供了一个基于 TypeScript 的参考引擎和一个 Python 包装器(pyATR)来评估这些规则。它还包含一个 CLI 工具,可用于扫描文件(如 SKILL.md 或 MCP 配置日志),并支持将规则导出为与 Splunk 和 Elasticsearch 等 SIEM 工具兼容的格式。
适用人群
- 安全工程师:用于在运行时实现对代理威胁的检测与阻断。
- 代理框架开发者:用于将安全扫描嵌入代理运行时、代理或 IDE 扩展中。
- 红队人员:可使用提供的技术目录(ATD)测试代理安全性。
- DevOps/CI 工程师:可通过 GitHub Actions 集成安全门禁。
主要亮点
- 标准化格式:一种机器可读、可同行评审的规则格式,类似于 Sigma 或 YARA,但专为 AI 代理设计。
- 多语言支持:提供 TypeScript 和 Python 的参考实现,已提出 Go 和 Rust 的契约。
- 灵活执行:支持“车道”(enforce、alert、hunt)以平衡精度与召回率,并提供可选的阻断模式以限制代理行为。
- 广泛集成:已集成至 Microsoft、Cisco 和 OWASP 的工具中,并支持 SARIF 输出以用于 GitHub 安全标签。
- 技术目录:包含 Agentic Threat Detection (ATD) 目录,将 80 种技术映射到 MITRE ATLAS 和 OWASP 的 9 个战术。
相关
- 项目
- 项目
- 项目
- Dispatch
- 项目