FailproofAI/failproofai

Observability and enforcement for AI agent harnesses. Capture every run and runtime reliability with policy enforcement. 40 built-in policies, a local dashboard, no account required with a generous free cloud plan

解决的问题

Failproof AI 是 AI 代理的安全与可观测性层。它通过在操作执行前阻止这些调用,防止代理执行危险操作——例如删除文件、泄露 API 密钥或执行破坏性 SQL 命令。同时,它提供对代理行为的可见性,使开发者能够审计运行记录并识别失败模式。

工作原理

该系统作为代理与环境之间的钩子或网关。它支持十二种不同的「Harness」(包括 Claude Code 和 GitHub Copilot CLI 等编码 CLI,以及 Hermes 和 OpenClaw 等网关),用于拦截工具调用。

用户可以为这些钩子应用策略。策略可以 allow() 操作,deny() 操作(阻止动作并返回消息给代理),或 instruct() 操作(允许通过但向代理的下一次提示添加上下文)。策略可以是内置的,也可以用 JavaScript 自定义编写,或从 GitHub 安装版本化的「策略包」。

适用人群

部署具有系统工具、数据库或基础设施访问权限的 AI 代理的开发者和团队,需要确保这些代理在无需持续人工监督的情况下安全运行。

主要亮点

  • 执行前阻断:在执行前阻止危险的工具调用(例如 rm -rfsudogit push --force)。
  • 广泛的 Harness 支持:开箱即用支持多种编码代理和网关。
  • 可自定义的安全性:支持自定义 JavaScript 策略和可共享的策略包。
  • 完整的可观测性:包含本地仪表板用于查看会话历史和追踪记录,以及托管版本用于全队监控、延迟跟踪和成本分析。
  • 审计能力:扫描历史记录中的高风险模式,并建议策略以防止它们发生。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目