brexhq/CrabTrap
An LLM-as-a-judge HTTP proxy to secure agents in production
解决的问题
CrabTrap 为与外部 API 交互的 AI 代理提供安全防护机制。它通过拦截流量并在请求到达互联网之前根据一组安全策略进行评估,防止代理发起未经授权或危险的出站 HTTP/HTTPS 请求。
工作原理
CrabTrap 作为一个正向代理运行,位于 AI 代理与外部世界之间。它使用 TLS 终止来解密 HTTPS 流量,然后应用两层评估流程:
- 静态规则:首先根据确定性的 URL 模式(前缀、精确匹配或通配符)检查请求。如果匹配,则立即允许或拒绝。
- LLM 判官:如果无静态规则匹配,则将请求发送给基于 LLM 的判官,根据为该代理定义的自然语言安全策略进行评估。
所有决策、请求和响应均记录到 PostgreSQL 数据库中以供审计。它还包含 SSRF 保护以阻止对私有网络的请求,并具备电路断路器以应对 LLM 故障。
适用对象
需要对调用外部服务(如 Slack、Gmail 或 GitHub)的 AI 代理强制执行安全策略并审计出站流量的开发者和组织。
主要亮点
- 双层评估:结合快速的确定性规则与灵活的自然语言 LLM 策略。
- HTTPS 拦截:支持自动 TLS 证书生成的透明 MITM 代理。
- SSRF 保护:内置防止对私有网络和 DNS 重绑定攻击的请求。
- 策略构建器:一个智能循环,分析流量模式以自动生成安全策略草案。
- 审计与评估:在 PostgreSQL 中提供完整的审计日志,并支持回放历史日志以测试策略准确性。
相关
- 项目
- 项目
- 项目
- 项目
- 项目