uber/ADR
ADR secures enterprise AI agents through observability, security benchmarking, and threat detection. Deployed at Uber.
解決的問題
ADR 提供一個企業級安全系統,旨在保護組織免受 AI 代理相關風險的影響。它解決了監控和保護員工使用的工具(如 Cursor 和 Claude Code)以及面向客戶的客服代理的需求,防止不安全操作,並即時檢測威脅。
工作原理
ADR 採用四部分安全框架:
- 可觀測性:傳感器收集並標準化來自各種作業系統和 AI 編碼工具的遙測資料——包括代理意圖、工具使用和執行追蹤。
- 基準測試:ADR-Bench 提供 300 多個任務和 133 個 MCP 伺服器,用於測試代理安全,涵蓋 17 種不同的攻擊技術。
- 檢測:採用兩級架構,先進行高召回率的初步篩選,再透過更深入的代理式推理,高效識別可疑會話。
- 預防:一個設計用於阻止不安全操作的組件(目前未包含在開源版本中)。
適用對象
需要在生產環境中監控、評估和保護 AI 代理的企业安全團隊和 AI 研究人員。
主要亮點
- 生產環境驗證:已在 Uber 部署,並在 MLSys 2026 上發表。
- 廣泛相容性:支援從 Claude Code、Cursor、Codex 和 Claude Desktop 等工具收集遙測資料。
- 全面測試:包含一個涵蓋全部 17 種已知代理攻擊技術的 303 個任務的基準測試。
- 雙代理檢測:採用先進的檢測系統,透過篩選與推理結合的方法識別高風險行為。
相關
- 專案
- 專案
- 專案
- 專案
- 專案