brexhq/CrabTrap

An LLM-as-a-judge HTTP proxy to secure agents in production

해결하는 문제

CrabTrap는 외부 API와 상호작용하는 AI 에이전트를 위한 보안 가드레일을 제공합니다. 요청이 인터넷에 도달하기 전에 트래픽을 가로채고 보안 정책에 따라 평가함으로써, 승인되지 않은 또는 위험한 아웃바운드 HTTP/HTTPS 요청을 방지합니다.

작동 방식

CrabTrap는 AI 에이전트와 외부 세계 사이에 위치하는 포워드 프록시로 작동합니다. TLS 종료를 통해 HTTPS 트래픽을 복호화한 후, 두 단계 평가 프로세스를 적용합니다:

  1. 정적 규칙: 먼저 요청을 결정론적 URL 패턴(접두사, 정확한 일치, 글로브)과 비교합니다. 일치하는 경우 즉시 허용 또는 거부됩니다.
  2. LLM 판사: 정적 규칙과 일치하지 않으면, 해당 에이전트에 대해 정의된 자연어 보안 정책에 따라 LLM 기반 판사에게 요청을 보냅니다.

모든 결정, 요청, 응답은 감사용으로 PostgreSQL 데이터베이스에 로그됩니다. 또한 사설 네트워크에 대한 요청을 차단하는 SSRF 보호 기능과 LLM 장애를 처리하는 회로 차단기 기능도 포함되어 있습니다.

대상 사용자

Slack, Gmail, GitHub과 같은 외부 서비스를 호출하는 AI 에이전트를 배포하고, 보안 정책을 강제하고 아웃바운드 트래픽을 감사할 수 있는 검증 가능한 방법이 필요한 개발자 및 조직입니다.

주요 기능

  • 이중 평가: 빠른 결정론적 규칙과 유연한 자연어 기반 LLM 정책을 결합합니다.
  • HTTPS 가로채기: 자동 TLS 인증서 생성을 지원하는 투명한 MITM 프록시입니다.
  • SSRF 보호: 사설 네트워크 및 DNS 리바인딩 공격에 대한 요청을 차단하는 내장 보호 기능입니다.
  • 정책 빌더: 트래픽 패턴을 분석하여 자동으로 보안 정책을 초안하는 에이전트 루프입니다.
  • 감사 및 평가: PostgreSQL에 완전한 감사 로그를 기록하고, 과거 로그를 재실행하여 정책 정확도를 테스트할 수 있는 시스템입니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트