rogue-security/rogue
AI Agent Evaluator & Red Team Platform
解決的問題
Rogue 是一個專為部署前對 AI 代理進行安全與評估測試而設計的平台。它可防止 AI 代理違反業務政策,或遭受可能導致安全漏洞的對抗性攻擊。
工作原理
該平台採用客戶端-伺服器架構,透過多種協定(A2A、MCP 或直接 Python 呼叫)探測 AI 代理。提供兩種主要運行模式:
- 自動評估:根據預定義的業務政策和情境測試代理,確保其合規性與預期行為。
- 紅隊測試:利用超過 75 個漏洞和 20 種攻擊技術(如提示注入、社會工程學)模擬對抗性攻擊,以發現安全漏洞。
結果由「裁判 LLM」分析,並使用基於 CVSS 的風險系統進行評分,以確定漏洞的嚴重程度。
適用對象
需要驗證 AI 代理行為、執行滲透測試,並確保符合 OWASP、MITRE ATLAS 和歐盟人工智能法案等框架的開發者與安全審計人員。
主要亮點
- 全面的紅隊測試:涵蓋 12 個類別中的 75+ 漏洞和 20+ 攻擊技術。
- 靈活整合:支援 Google 的 Agent-to-Agent (A2A) 協定、Model Context Protocol (MCP) 和直接 Python 入口點。
- 合規性映射:與 NIST AI RMF、GDPR 和 ISO/IEC 42001 等產業標準對齊。
- 多接口支援:提供用於互動式測試的 TUI、用於 CI/CD 流水線的 CLI 以及獨立伺服器。
- 決定性測試:支援隨機種子,實現可重現的安全掃描。
相關
- 專案
- 專案
- 專案
- 專案
- 專案