rogue-security/rogue

AI Agent Evaluator & Red Team Platform

解決的問題

Rogue 是一個專為部署前對 AI 代理進行安全與評估測試而設計的平台。它可防止 AI 代理違反業務政策,或遭受可能導致安全漏洞的對抗性攻擊。

工作原理

該平台採用客戶端-伺服器架構,透過多種協定(A2A、MCP 或直接 Python 呼叫)探測 AI 代理。提供兩種主要運行模式:

  1. 自動評估:根據預定義的業務政策和情境測試代理,確保其合規性與預期行為。
  2. 紅隊測試:利用超過 75 個漏洞和 20 種攻擊技術(如提示注入、社會工程學)模擬對抗性攻擊,以發現安全漏洞。

結果由「裁判 LLM」分析,並使用基於 CVSS 的風險系統進行評分,以確定漏洞的嚴重程度。

適用對象

需要驗證 AI 代理行為、執行滲透測試,並確保符合 OWASP、MITRE ATLAS 和歐盟人工智能法案等框架的開發者與安全審計人員。

主要亮點

  • 全面的紅隊測試:涵蓋 12 個類別中的 75+ 漏洞和 20+ 攻擊技術。
  • 靈活整合:支援 Google 的 Agent-to-Agent (A2A) 協定、Model Context Protocol (MCP) 和直接 Python 入口點。
  • 合規性映射:與 NIST AI RMF、GDPR 和 ISO/IEC 42001 等產業標準對齊。
  • 多接口支援:提供用於互動式測試的 TUI、用於 CI/CD 流水線的 CLI 以及獨立伺服器。
  • 決定性測試:支援隨機種子,實現可重現的安全掃描。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案