SafeAI-Lab-X/ClawKeeper

ClawKeeper: Comprehensive Safety Protection for OpenClaw Agents Through Skills, Plugins, and Watchers (aka The Norton for OpenClaw)

해결하는 문제

ClawKeeper는 쉘, Python, 브라우저 접근과 같은 도구를 사용하는 에이전트 시스템을 위한 보안 계층을 제공합니다. 위험한 명령어 실행, 자격 증명 유출, 프롬프트 인젝션 및 오염된 도구 출력에 대한 취약성을 방지합니다.

작동 방식

AI 에이전트와 도구 사이에 배치되는 호스트에 구애받지 않는 미들웨어로 작동합니다. 'Judge'를 사용해 위험한 도구 호출을 차단하고 민감한 결과를 마스킹합니다. 의도나 도구 사용 이력 이해가 필요한 복잡한 판단은 선택적 'Watcher' 데몬에 위임할 수 있으며, 에이전트의 진행 경로를 추론합니다. 시스템은 학습된 공격 패턴을 합성하고 가드 레이어에 핫리로드함으로써 자가 개선이 가능합니다.

대상 사용자

Hermes Agent나 MCP 도구와 같은 다양한 런타임에서 도구 실행을 안전하게 보장하고, SSRF나 자격 증명 유출과 같은 보안 결함을 방지해야 하는 도구 기반 에이전트를 개발하는 개발자들입니다.

주요 특징

  • 호스트 독립성: Python 임포트 또는 비-Python 어댑터용 HTTP 서버를 통해 작동 가능.
  • 다층 방어: 결정론적 가드 규칙과 LLM 기반 Watcher를 결합하여 궤적 수준의 추론 가능.
  • 자기 개선: 학습된 공격 패턴을 지속 저장하고 가드 레이어에 핫리로드하여 가드 커버리지를 향상.
  • 포괄적인 가드 세트: 쉘 실행, 보호된 경로 접근, SSRF 패턴, 인코딩된 페이로드를 모두 커버.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트