secureagentics/Adrian
Open-source runtime AI agent security tool - monitors and controls AI agents, catching malicious tool use, prompt injection, and policy drift in real time, before the agent acts.
해결하는 문제
Adrian은 AI 에이전트의 악의적 또는 비일치된 행동을 방지하기 위한 런타임 보안 계층을 제공합니다. 정적 분석과 네트워크 모니터링의 한계를 보완하여, 프롬프트 인젝션, 점프브레이크, 툴 풀링, 데이터 유출, 권한 상승과 같은 기존 방법으로는 탐지되지 않는 공격을 감지합니다.
작동 방식
전통적인 모니터링이 활동 로그(도구 호출 및 API 상호작용 등)만을 확인하는 반면, Adrian은 에이전트의 실제 행동과 내부 추론 트레이스를 모두 분석합니다. 에이전트가 행동하는 '이유'를 이해하고 세션 전체에 걸쳐 이를 연관 지음으로써, 학습 데이터에 존재하지 않더라도 에이전트가 '범위를 벗어남' (예: 전자상거래 에이전트가 비밀번호를 재설정)하는 상황을 식별할 수 있습니다.
대상 사용자
LangChain, LangGraph, Anthropic의 SDK 등을 사용하는 AI 에이전트 개발자 및 Claude Code 사용자를 대상으로 합니다. 에이전트가 정의된 범위 내에서 작동하도록 보장하고자 하며, 관리형 클라우드 대시보드 또는 완전히 자체 호스팅하여 데이터 주권을 확보하고자 하는 사용자에게 적합합니다.
주요 기능
- 추론 인식 모니터링: 행동 분석과 추론 분석을 결합하여 행동 중심 모니터링보다 더 세밀한 공격을 탐지 가능.
- 실행 중 개입: 위험한 행동을 실행 전에 차단하거나 인간의 승인을 기다리게 할 수 있음.
- 광범위한 통합: Python 및 TypeScript SDK를 지원하며, Claude Code용 네이티브 플러그인과 LangChain 지원도 제공.
- 자체 호스팅 가능: Docker를 통한 전체 스택 배포 가능. 오프라인 및 데이터 주권 환경을 위한 로컬 분류 모델(Gemma 4)은 Llama.cpp를 통해 제공.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트