rogue-security/rogue

AI Agent Evaluator & Red Team Platform

해결하는 문제

Rogue는 AI 에이전트를 배포하기 전에 보안 및 평가를 철저히 테스트하기 위한 플랫폼입니다. AI 에이전트가 비즈니스 정책을 위반하거나 악성 공격에 노출되어 보안 취약점을 유발하는 것을 방지합니다.

작동 방식

이 플랫폼은 클라이언트-서버 아키텍처를 사용하여 여러 프로토콜(A2A, MCP, 또는 직접적인 Python 호출)을 통해 AI 에이전트를 탐색합니다. 주로 다음 두 가지 모드로 작동합니다:

  1. 자동 평가: 사전 정의된 비즈니스 정책과 시나리오에 따라 에이전트를 테스트하여 준수 여부와 예상되는 동작을 확인합니다.
  2. 레드팀: 프롬프트 인젝션, 사회공학 등 75개 이상의 취약점과 20가지 이상의 공격 기법을 사용하여 악성 공격을 시뮬레이션하여 보안적 구멍을 발견합니다.

결과는 "판정 LLM"에 의해 분석되며, CVSS 기반의 위험 시스템을 사용해 취약성의 심각도를 평가합니다.

대상 사용자

AI 에이전트의 동작을 검증하고, 펜테스트를 수행하며, OWASP, MITRE ATLAS, EU AI Act 등의 프레임워크 준수를 보장해야 하는 개발자 및 보안 감사 담당자.

주요 기능

  • 포괄적인 레드팀 기능: 12개 카테고리에 걸쳐 75개 이상의 취약점과 20개 이상의 공격 기법을 포함합니다.
  • 유연한 통합: Google의 Agent-to-Agent(A2A) 프로토콜, Model Context Protocol(MCP), 그리고 직접적인 Python 엔트리포인트를 지원합니다.
  • 준수 매핑: NIST AI RMF, GDPR, ISO/IEC 42001 등의 산업 표준과 일치합니다.
  • 다양한 인터페이스: 인터랙티브 테스트용 TUI, CI/CD 파이프라인용 CLI, 독립 서버를 제공합니다.
  • 결정론적 테스트: 재현 가능한 보안 스캔을 위해 랜덤 시드를 지원합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트