uber/ADR
ADR secures enterprise AI agents through observability, security benchmarking, and threat detection. Deployed at Uber.
解决的问题
ADR 提供一个企业级安全系统,旨在保护组织免受 AI 代理相关风险的影响。它解决了监控和保护员工使用的工具(如 Cursor 和 Claude Code)以及面向客户的客服代理的需求,防止不安全操作,并实时检测威胁。
工作原理
ADR 采用四部分安全框架:
- 可观测性:传感器收集并标准化来自各种操作系统和 AI 编码工具的遥测数据——包括代理意图、工具使用和执行追踪。
- 基准测试:ADR-Bench 提供 300 多个任务和 133 个 MCP 服务器,用于测试代理安全,覆盖 17 种不同的攻击技术。
- 检测:采用两级架构,先进行高召回率的初步筛选,再通过更深入的代理式推理,高效识别可疑会话。
- 预防:一个设计用于阻止不安全操作的组件(当前未包含在开源版本中)。
适用对象
需要在生产环境中监控、评估和保护 AI 代理的企业安全团队和 AI 研究人员。
主要亮点
- 生产环境验证:已在 Uber 部署,并在 MLSys 2026 上发表。
- 广泛兼容性:支持从 Claude Code、Cursor、Codex 和 Claude Desktop 等工具收集遥测数据。
- 全面测试:包含一个涵盖全部 17 种已知代理攻击技术的 303 个任务的基准测试。
- 双代理检测:采用先进的检测系统,通过筛选与推理相结合的方法识别高风险行为。
相关
- 项目
- 项目
- 项目
- 项目
- 项目