rogue-security/rogue
AI Agent Evaluator & Red Team Platform
何を解決するか
Rogue は、AIエージェントの展開前にセキュリティと評価を徹底的に検証するためのプラットフォームです。AIエージェントがビジネスポリシーを違反したり、悪意ある攻撃に遭ってセキュリティ上の脆弱性を引き起こすのを防ぎます。
動作方法
このプラットフォームはクライアント-サーバー構造を採用し、複数のプロトコル(A2A、MCP、または直接的なPython呼び出し)を通じてAIエージェントを検証します。主に以下の2つのモードで動作します:
- 自動評価:事前に定義されたビジネスポリシーとシナリオに基づいてエージェントをテストし、コンプライアンスと期待される動作を確認します。
- レッドチーム:75以上の脆弱性と20以上の攻撃手法(プロンプトインジェクションやソーシャルエンジニアリングなど)を用いて悪意ある攻撃をシミュレートし、セキュリティ上の隙を発見します。
結果は「ジャッジLLM」によって分析され、CVSSベースのリスクシステムでスコア付けされ、脆弱性の深刻度が判定されます。
対象ユーザー
AIエージェントの挙動を検証し、ペネトレーションテストを実施し、OWASP、MITRE ATLAS、EU AI Actなどのフレームワークに準拠していることを確認したい開発者やセキュリティ監査担当者。
特徴
- 包括的なレッドチーム機能:12のカテゴリにまたがる75以上の脆弱性と20以上の攻撃手法を含む。
- 柔軟な統合:GoogleのAgent-to-Agent(A2A)プロトコル、Model Context Protocol(MCP)、および直接的なPythonエントリポイントをサポート。
- コンプライアンス対応:NIST AI RMF、GDPR、ISO/IEC 42001などの業界標準と整合。
- 複数のインターフェース:インタラクティブなテスト用のTUI、CI/CDパイプライン用のCLI、およびスタンドアロンサーバーを提供。
- 決定論的テスト:再現可能なセキュリティスキャンのためのランダムシードをサポート。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト