GoPlusSecurity/agentguard

Security guard for AI agents — blocks malicious skills, prevents data leaks, protects secrets. 24 detection rules, runtime action evaluation, trust registry.

GoPlus AgentGuard – AI 代理人的安全卫士

是什么 – 一个基于 Node 的命令行工具(及插件),位于 AI 编码代理(Claude Code、OpenClaw、Hermes、Codex 等)与主机系统之间。它监控代理尝试执行的每一项命令、文件写入、网络请求以及技能/插件,应用一组静态分析和运行时规则,以阻止或警告危险操作。

为何重要 – 现代 AI 代理可能被授予完整的终端访问权限。恶意技能或提示注入攻击可悄然窃取密钥、耗尽加密钱包或清空磁盘。AgentGuard 提供实时安全层,具备以下功能:

  • 钩入代理的执行流水线,阻止已知的破坏性命令(如 rm -rf /、fork bombs、curl|bash)。
  • 防止向凭证位置(如 .env~/.ssh)写入文件。
  • 检测对常见 Webhook 端点(Discord、Telegram、Slack)的信息外泄尝试。
  • 追踪每个操作由哪个技能发起,以便归因滥用行为。
  • 提供每日“巡逻”功能,对整个环境进行审计,检查篡改、密钥泄露、开放端口、可疑 cron 任务和信任注册表健康状况。

如何获取 – 使用 npm 全局安装,并运行一次 agentguard init,它将自动检测支持的代理并安装相应的钩子/插件。

npm install -g @goplus/agentguard
agentguard init   # 自动检测 Claude、OpenClaw、Hermes 等

本地守护程序无需云账户;可选的云连接可用于威胁情报馈送和集中式审计同步。

主要功能(如 README 所述)

层级 功能
自动守护(钩子) 实时阻止破坏性 shell 命令、向密钥文件写入、已知的信息外泄 URL。追踪技能来源。
深度扫描(技能) 对技能/插件进行按需静态分析(24 项检测规则)。查找密钥、后门、混淆、提示注入模式以及 Web3 特有的钱包攻击。生成带有基于能力权限的可信注册表条目。
每日巡逻(OpenClaw) 定时任务(默认 03:00 UTC)执行八项全面检查:完整性、密钥暴露、网络暴露、cron 任务安全性、文件系统变更、审计日志分析、配置健康度、可信注册表健康度。生成简洁的 PASS/WARN/FAIL 报告,并记录到 ~/.agentguard/audit.jsonl
健康检查 一键生成 HTML 报告,包含“龙虾”视觉评分,总结代码安全、信任卫生、运行时防御、密钥保护、Web3 防护和配置姿态。
保护级别 strict(阻止所有风险操作)、balanced(阻止危险操作,对风险操作询问 – 默认)、permissive(仅阻止关键威胁)。
云 / 威胁情报(可选) agentguard connect 注册本地 JWT,拉取安全通告,可将脱敏审计日志同步至 GoPlus 云。

典型工作流

  1. 安装与初始化npm i -g @goplus/agentguard && agentguard init
  2. 扫描新技能agentguard scan ./my-skill(或 DSH 插件使用 agentguard dsh-scan …)。CLI 返回人类可读或 JSON 格式的风险报告。
  3. 评估单个操作 – 将工具调用的 JSON 描述通过管道传入 agentguard protect,查看是否会被阻止。
  4. 运行每日巡逻agentguard patrol run 或使用 agentguard patrol setup 设置为 cron 任务。
  5. 查看报告agentguard report 查看审计日志,agentguard checkup 查看可视化健康页面,或 agentguard trust list 查看当前受信任的技能。

支持的代理 / 集成

  • Claude Code – 通过 claude plugin add … 的原生插件。
  • OpenClaw – 注册为 OpenClaw 插件(registerOpenClawPlugin)。钩入 before_tool_call / after_tool_call 事件。
  • Hermes、Codex、QClaw、DSH – 每个都有特定的初始化标志(agentguard init --agent <name>),用于安装相应的钩子包。

限制 / 范围(如 README 所述)

  • 深度扫描规则为静态;无法捕捉源代码中未反映的仅运行时行为。
  • 巡逻功能与 OpenClaw 环境绑定;非 OpenClaw 用户需手动扫描。
  • 远程代码执行检测依赖启发式方法(如 npxnpm execcurl|bash)。使用精确提交以减少警告。
  • 该工具无需云连接,但高级威胁情报和集中审计功能需要可选 API 密钥。
  • 某些 DSH 特有功能(运行时模式、所有者归属)仅在 DSH 运行时暴露所需合约时可用。

总结 – AgentGuard 是专为 AI 编码代理设计的安全层,为开发者提供一种简便方式,强制执行最小权限执行,自动扫描新插件,并对整个代理生态系统进行每日健康检查。这是一个真正、积极维护的开源项目,旨在应对 AI 驱动自动化带来的新兴风险面。

相关

  • 项目
  • 项目
  • 项目
  • Dispatch
  • 项目