msoedov/agentic_security
Agentic LLM Vulnerability Scanner / AI red teaming kit 🧪
解决的问题
Agentic Security 是一款开源漏洞扫描器,旨在保护大语言模型 (LLM) 和智能体工作流免受安全威胁。它帮助开发人员和安全团队在部署到生产环境之前,主动识别越狱、模糊测试漏洞和多模态攻击等弱点。
工作原理
该工具通过使用多种攻击向量探测 LLM API 来运行。它使用纯文本 HTTP 规范连接到目标模型,并将占位符替换为特定的攻击提示词。它可以从 Hugging Face、本地 CSV 文件加载数据集,或使用变异(如 Base64 编码或 ROT13)生成动态数据集以绕过安全过滤器。该系统支持文本、图像和音频模态,并可以作为自动化安全检查集成到 CI/CD 流水线中。
适用对象
本项目面向需要对其 AI 系统进行压力测试并确保其能够抵御对抗性攻击的 AI 开发人员、安全研究人员和安全团队。
亮点
- 多模态探测:支持对文本、图像和音频输入进行漏洞扫描。
- 多步越狱:模拟迭代攻击序列以发现深层的安全弱点。
- 基于 RL 的攻击:使用强化学习创建能够针对模型防御进行进化的自适应探测器。
- CI/CD 集成:包含用于开发期间自动化安全扫描的示例 GitHub Action。
- 可扩展的数据集:允许用户添加自定义 CSV 数据集或集成来自 Hugging Face 的现有数据集。
相关
- 项目
- 项目
- Dispatch
- 项目
- 项目