0din-ai/ai-scanner
AI model safety scanner built on NVIDIA garak
解決的問題
它為組織在部署 AI 模型之前進行安全評估提供了一種方法。它作為專門針對 AI 系統的滲透測試工具,識別可能在生產環境中被利用的越獄及其他安全缺陷等漏洞。
工作原理
該應用程式基於 Ruby on Rails 構建,並由 NVIDIA garak 提供支持,會對目標 AI 系統運行一系列「探測器」(攻擊提示詞)。這些目標可以是基於 API 的 LLM 或基於瀏覽器的聊天介面。系統會追蹤攻擊成功率 (ASR),並提供關於哪些探測器成功繞過模型安全過濾器的詳細日誌與報告。
適用對象
需要針對已知攻擊向量驗證其 AI 系統安全性與魯棒性的安全團隊、AI 開發人員以及部署 LLM 的組織。
亮點
廣泛的探測器庫:包含涵蓋 35 個漏洞家族的 179 個社群探測器,與 OWASP LLM Top 10 保持一致。
真實世界的攻擊:內置了實際由 0DIN 公開的越獄手段以及每種攻擊的多種可重定向變體。
企業級功能:支持多租戶部署、定期掃描和 SIEM 集成(Splunk 或 Rsyslog)。
全面的報告:提供具有鑽取功能和攻擊成功率趨勢追蹤功能的 PDF 匯出。
相關
- 專案
- 專案
- 專案
- 專案
- 專案