msoedov/agentic_security
Agentic LLM Vulnerability Scanner / AI red teaming kit 🧪
解決的問題
Agentic Security 是一款開源漏洞掃描器,旨在保護大型語言模型 (LLM) 和代理工作流免受安全威脅。它幫助開發人員和安全團隊在部署到生產環境之前,主動識別越獄、模糊測試漏洞和多模態攻擊等弱點。
工作原理
該工具透過使用多種攻擊向量探測 LLM API 來運行。它使用純文本 HTTP 規範連接到目標模型,並將佔位符替換為特定的攻擊提示詞。它可以從 Hugging Face、本地 CSV 檔案載入數據集,或使用變異(如 Base64 編碼或 ROT13)生成動態數據集以繞過安全過濾器。該系統支援文本、圖像和音訊模態,並可以作為自動化安全檢查整合到 CI/CD 流水線中。
適用對象
本專案面向需要對其 AI 系統進行壓力測試並確保其能夠抵禦對抗性攻擊的 AI 開發人員、安全研究人員和安全團隊。
亮點
- 多模態探測:支援對文本、圖像和音訊輸入進行漏洞掃描。
- 多步越獄:模擬迭代攻擊序列以發現深層的安全弱點。
- 基於 RL 的攻擊:使用強化學習建立能夠針對模型防禦進行進化的自適應探測器。
- CI/CD 整合:包含用於開發期間自動化安全掃描的範例 GitHub Action。
- 可擴展的數據集:允許用戶添加自定義 CSV 數據集或整合來自 Hugging Face 的現有數據集。
相關
- 專案
- 專案
- Dispatch
- 專案
- 專案