rogue-security/rogue
AI Agent Evaluator & Red Team Platform
解决的问题
Rogue 是一个专为部署前对 AI 代理进行安全与评估测试而设计的平台。它可防止 AI 代理违反业务政策,或遭受可能导致安全漏洞的对抗性攻击。
工作原理
该平台采用客户端-服务器架构,通过多种协议(A2A、MCP 或直接 Python 调用)探测 AI 代理。提供两种主要运行模式:
- 自动评估:根据预定义的业务政策和场景测试代理,确保其合规性与预期行为。
- 红队测试:利用超过 75 个漏洞和 20 种攻击技术(如提示注入、社会工程学)模拟对抗性攻击,以发现安全漏洞。
结果由“裁判 LLM”分析,并使用基于 CVSS 的风险系统进行评分,以确定漏洞的严重程度。
适用人群
需要验证 AI 代理行为、执行渗透测试,并确保符合 OWASP、MITRE ATLAS 和欧盟人工智能法案等框架的开发者和安全审计人员。
主要亮点
- 全面的红队测试:涵盖 12 个类别中的 75+ 漏洞和 20+ 攻击技术。
- 灵活集成:支持 Google 的 Agent-to-Agent (A2A) 协议、Model Context Protocol (MCP) 和直接 Python 入口点。
- 合规性映射:与 NIST AI RMF、GDPR 和 ISO/IEC 42001 等行业标准对齐。
- 多接口支持:提供用于交互式测试的 TUI、用于 CI/CD 流水线的 CLI 以及独立服务器。
- 确定性测试:支持随机种子,实现可复现的安全扫描。
相关
- 项目
- 项目
- 项目
- 项目
- 项目