secureagentics/Adrian
Open-source runtime AI agent security tool - monitors and controls AI agents, catching malicious tool use, prompt injection, and policy drift in real time, before the agent acts.
解決的問題
Adrian 為 AI 代理提供執行時安全層,防止惡意或不一致的行為。它彌補了靜態分析與網路監控的限制,能夠偵測到傳統方法難以發現的攻擊,例如提示注入、越獄、工具污染、資料外洩與權限提升。
工作原理
與僅查看活動日誌(如工具呼叫與 API 互動)的傳統監控不同,Adrian 同時分析代理的實際行為與其內部推理軌跡。透過理解代理採取某個行為的『原因』,並跨會話進行關聯分析,即使該行為未在訓練資料中出現,也能識別代理是否『越界』(例如電商代理重設密碼)。
適用對象
適用於使用 LangChain、LangGraph 或 Anthropic SDK 建構 AI 代理的開發者,以及 Claude Code 使用者。專為需要確保代理在定義範圍內運作的使用者設計,可透過托管雲儀表板部署,亦可完全自托管以保障資料主權。
主要亮點
- 推理感知監控:結合行為與推理分析,比僅基於行為的監控能發現更細微的攻擊。
- 執行時干預:可在執行前阻止或暫停高風險操作,等待人工審核。
- 廣泛整合:支援 Python 與 TypeScript SDK,原生支援 Claude Code,並相容 LangChain。
- 自托管能力:透過 Docker 完整部署,包含本地分類模型(Gemma 4)透過 Llama.cpp 實現,適用於離線與資料主權環境。
相關
- 專案
- 專案
- 專案
- 專案
- 專案