AISecurityLab/hackagent
HackAgent is an open-source security toolkit to detect vulnerabilities of your AI Agents
它解决了什么问题
HackAgent 是一个安全红队工具包,旨在发现 AI 代理中的漏洞。它解决了提示注入、越狱、目标劫持和工具滥用等风险,而传统安全工具无法检测这些风险。
它如何工作
它使用一个模块化流程,包括一个攻击引擎,用于协调各种基于研究的攻击技术(如 PAIR、TAP 和 AutoDAN-Turbo),一个生成式 LLM 用于创建对抗性提示,以及一个评判式 LLM 用于评估安全措施是否被绕过。该过程是自动化的,可用于测试基于 LangChain、OpenAI SDK、LiteLLM 和 Google ADK 等框架构建的目标代理。
适合谁使用
需要评估并增强其 AI 代理鲁棒性的安全研究人员、开发者和 AI 安全实践者。
主要亮点
- 自动化红队测试:使用多种先进攻击技术,自动发现安全缺陷。
- 广泛的框架支持:兼容主流 AI 代理框架,包括 LangChain 和 OpenAI SDK。
- 灵活的报告功能:提供基于本地 SQLite 的仪表板和基于云的报告平台。
- 易于部署:提供 Python SDK、CLI 和适用于多个平台的独立二进制文件。
相关
- 项目
- 项目
- 项目
- 项目
- 项目