brexhq/CrabTrap

An LLM-as-a-judge HTTP proxy to secure agents in production

解決的問題

CrabTrap 為與外部 API 互動的 AI 代理提供安全防護機制。它透過攔截流量,並在請求抵達網際網路之前根據一組安全策略進行評估,防止代理發起未經授權或危險的出站 HTTP/HTTPS 請求。

工作原理

CrabTrap 作為一個正向代理運作,位於 AI 代理與外部世界之間。它使用 TLS 終止來解密 HTTPS 流量,然後應用兩層評估流程:

  1. 靜態規則:首先根據決定性的 URL 模式(前綴、精確匹配或通配符)檢查請求。如果匹配,則立即允許或拒絕。
  2. LLM 判官:若無靜態規則匹配,則將請求送至基於 LLM 的判官,根據為該代理定義的自然語言安全策略進行評估。

所有決策、請求與回應均記錄至 PostgreSQL 資料庫以供審計。它還包含 SSRF 保護以阻止對私人網路的請求,並具備電路斷路器以應對 LLM 故障。

適用對象

需要對呼叫外部服務(如 Slack、Gmail 或 GitHub)的 AI 代理強制執行安全策略並審計出站流量的開發者與組織。

主要亮點

  • 雙層評估:結合快速的決定性規則與靈活的自然語言 LLM 策略。
  • HTTPS 拦截:支援自動 TLS 憑證生成的透明 MITM 代理。
  • SSRF 保護:內建防止對私人網路與 DNS 重繫攻擊的請求。
  • 策略建構器:一個智能循環,分析流量模式以自動產生安全策略草案。
  • 審計與評估:在 PostgreSQL 中提供完整的審計日誌,並支援回放歷史日誌以測試策略準確性。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案