brexhq/CrabTrap
An LLM-as-a-judge HTTP proxy to secure agents in production
解決的問題
CrabTrap 為與外部 API 互動的 AI 代理提供安全防護機制。它透過攔截流量,並在請求抵達網際網路之前根據一組安全策略進行評估,防止代理發起未經授權或危險的出站 HTTP/HTTPS 請求。
工作原理
CrabTrap 作為一個正向代理運作,位於 AI 代理與外部世界之間。它使用 TLS 終止來解密 HTTPS 流量,然後應用兩層評估流程:
- 靜態規則:首先根據決定性的 URL 模式(前綴、精確匹配或通配符)檢查請求。如果匹配,則立即允許或拒絕。
- LLM 判官:若無靜態規則匹配,則將請求送至基於 LLM 的判官,根據為該代理定義的自然語言安全策略進行評估。
所有決策、請求與回應均記錄至 PostgreSQL 資料庫以供審計。它還包含 SSRF 保護以阻止對私人網路的請求,並具備電路斷路器以應對 LLM 故障。
適用對象
需要對呼叫外部服務(如 Slack、Gmail 或 GitHub)的 AI 代理強制執行安全策略並審計出站流量的開發者與組織。
主要亮點
- 雙層評估:結合快速的決定性規則與靈活的自然語言 LLM 策略。
- HTTPS 拦截:支援自動 TLS 憑證生成的透明 MITM 代理。
- SSRF 保護:內建防止對私人網路與 DNS 重繫攻擊的請求。
- 策略建構器:一個智能循環,分析流量模式以自動產生安全策略草案。
- 審計與評估:在 PostgreSQL 中提供完整的審計日誌,並支援回放歷史日誌以測試策略準確性。
相關
- 專案
- 專案
- 專案
- 專案
- 專案