uber/ADR

ADR secures enterprise AI agents through observability, security benchmarking, and threat detection. Deployed at Uber.

解决的问题

ADR 提供一个企业级安全系统,旨在保护组织免受 AI 代理相关风险的影响。它解决了监控和保护员工使用的工具(如 Cursor 和 Claude Code)以及面向客户的客服代理的需求,防止不安全操作,并实时检测威胁。

工作原理

ADR 采用四部分安全框架:

  • 可观测性:传感器收集并标准化来自各种操作系统和 AI 编码工具的遥测数据——包括代理意图、工具使用和执行追踪。
  • 基准测试:ADR-Bench 提供 300 多个任务和 133 个 MCP 服务器,用于测试代理安全,覆盖 17 种不同的攻击技术。
  • 检测:采用两级架构,先进行高召回率的初步筛选,再通过更深入的代理式推理,高效识别可疑会话。
  • 预防:一个设计用于阻止不安全操作的组件(当前未包含在开源版本中)。

适用对象

需要在生产环境中监控、评估和保护 AI 代理的企业安全团队和 AI 研究人员。

主要亮点

  • 生产环境验证:已在 Uber 部署,并在 MLSys 2026 上发表。
  • 广泛兼容性:支持从 Claude Code、Cursor、Codex 和 Claude Desktop 等工具收集遥测数据。
  • 全面测试:包含一个涵盖全部 17 种已知代理攻击技术的 303 个任务的基准测试。
  • 双代理检测:采用先进的检测系统,通过筛选与推理相结合的方法识别高风险行为。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目