GoPlusSecurity/agentguard
Security guard for AI agents — blocks malicious skills, prevents data leaks, protects secrets. 24 detection rules, runtime action evaluation, trust registry.
GoPlus AgentGuard – AI 代理人的安全卫士
是什么 – 一个基于 Node 的命令行工具(及插件),位于 AI 编码代理(Claude Code、OpenClaw、Hermes、Codex 等)与主机系统之间。它监控代理尝试执行的每一项命令、文件写入、网络请求以及技能/插件,应用一组静态分析和运行时规则,以阻止或警告危险操作。
为何重要 – 现代 AI 代理可能被授予完整的终端访问权限。恶意技能或提示注入攻击可悄然窃取密钥、耗尽加密钱包或清空磁盘。AgentGuard 提供实时安全层,具备以下功能:
- 钩入代理的执行流水线,阻止已知的破坏性命令(如
rm -rf /、fork bombs、curl|bash)。 - 防止向凭证位置(如
.env和~/.ssh)写入文件。 - 检测对常见 Webhook 端点(Discord、Telegram、Slack)的信息外泄尝试。
- 追踪每个操作由哪个技能发起,以便归因滥用行为。
- 提供每日“巡逻”功能,对整个环境进行审计,检查篡改、密钥泄露、开放端口、可疑 cron 任务和信任注册表健康状况。
如何获取 – 使用 npm 全局安装,并运行一次 agentguard init,它将自动检测支持的代理并安装相应的钩子/插件。
npm install -g @goplus/agentguard
agentguard init # 自动检测 Claude、OpenClaw、Hermes 等
本地守护程序无需云账户;可选的云连接可用于威胁情报馈送和集中式审计同步。
主要功能(如 README 所述)
| 层级 | 功能 |
|---|---|
| 自动守护(钩子) | 实时阻止破坏性 shell 命令、向密钥文件写入、已知的信息外泄 URL。追踪技能来源。 |
| 深度扫描(技能) | 对技能/插件进行按需静态分析(24 项检测规则)。查找密钥、后门、混淆、提示注入模式以及 Web3 特有的钱包攻击。生成带有基于能力权限的可信注册表条目。 |
| 每日巡逻(OpenClaw) | 定时任务(默认 03:00 UTC)执行八项全面检查:完整性、密钥暴露、网络暴露、cron 任务安全性、文件系统变更、审计日志分析、配置健康度、可信注册表健康度。生成简洁的 PASS/WARN/FAIL 报告,并记录到 ~/.agentguard/audit.jsonl。 |
| 健康检查 | 一键生成 HTML 报告,包含“龙虾”视觉评分,总结代码安全、信任卫生、运行时防御、密钥保护、Web3 防护和配置姿态。 |
| 保护级别 | strict(阻止所有风险操作)、balanced(阻止危险操作,对风险操作询问 – 默认)、permissive(仅阻止关键威胁)。 |
| 云 / 威胁情报(可选) | agentguard connect 注册本地 JWT,拉取安全通告,可将脱敏审计日志同步至 GoPlus 云。 |
典型工作流
- 安装与初始化 –
npm i -g @goplus/agentguard && agentguard init。 - 扫描新技能 –
agentguard scan ./my-skill(或 DSH 插件使用agentguard dsh-scan …)。CLI 返回人类可读或 JSON 格式的风险报告。 - 评估单个操作 – 将工具调用的 JSON 描述通过管道传入
agentguard protect,查看是否会被阻止。 - 运行每日巡逻 –
agentguard patrol run或使用agentguard patrol setup设置为 cron 任务。 - 查看报告 –
agentguard report查看审计日志,agentguard checkup查看可视化健康页面,或agentguard trust list查看当前受信任的技能。
支持的代理 / 集成
- Claude Code – 通过
claude plugin add …的原生插件。 - OpenClaw – 注册为 OpenClaw 插件(
registerOpenClawPlugin)。钩入before_tool_call/after_tool_call事件。 - Hermes、Codex、QClaw、DSH – 每个都有特定的初始化标志(
agentguard init --agent <name>),用于安装相应的钩子包。
限制 / 范围(如 README 所述)
- 深度扫描规则为静态;无法捕捉源代码中未反映的仅运行时行为。
- 巡逻功能与 OpenClaw 环境绑定;非 OpenClaw 用户需手动扫描。
- 远程代码执行检测依赖启发式方法(如
npx、npm exec、curl|bash)。使用精确提交以减少警告。 - 该工具无需云连接,但高级威胁情报和集中审计功能需要可选 API 密钥。
- 某些 DSH 特有功能(运行时模式、所有者归属)仅在 DSH 运行时暴露所需合约时可用。
总结 – AgentGuard 是专为 AI 编码代理设计的安全层,为开发者提供一种简便方式,强制执行最小权限执行,自动扫描新插件,并对整个代理生态系统进行每日健康检查。这是一个真正、积极维护的开源项目,旨在应对 AI 驱动自动化带来的新兴风险面。
相关
- 项目
- 项目
- 项目
- Dispatch
- 项目