secureagentics/Adrian
Open-source runtime AI agent security tool - monitors and controls AI agents, catching malicious tool use, prompt injection, and policy drift in real time, before the agent acts.
解决的问题
Adrian 为 AI 代理提供运行时安全层,防止恶意或不一致的行为。它弥补了静态分析和网络监控的局限性,能够检测到传统方法难以发现的攻击,例如提示注入、越狱、工具污染、数据外泄和权限提升。
工作原理
与仅查看活动日志(如工具调用和 API 交互)的传统监控不同,Adrian 同时分析代理的实际行为和其内部推理轨迹。通过理解代理采取某个行为的‘原因’,并跨会话进行关联分析,即使该行为未在训练集中出现,也能识别代理是否‘越界’(例如电商代理重置密码)。
适用人群
适用于使用 LangChain、LangGraph 或 Anthropic SDK 构建 AI 代理的开发者,以及 Claude Code 用户。专为需要确保代理在定义范围内运行的用户设计,可通过托管云仪表板部署,也可完全自托管以保障数据主权。
主要亮点
- 推理感知监控:结合行为与推理分析,比仅基于行为的监控能发现更细微的攻击。
- 运行时干预:可在执行前阻止或暂停高风险操作,等待人工审批。
- 广泛集成:支持 Python 和 TypeScript SDK,原生支持 Claude Code,并兼容 LangChain。
- 自托管能力:通过 Docker 完整部署,包含本地分类模型(Gemma 4)通过 Llama.cpp 实现,适用于离线和数据主权环境。
相关
- 项目
- 项目
- 项目
- 项目
- 项目