0din-ai/ai-scanner

AI model safety scanner built on NVIDIA garak

解決的問題

它為組織在部署 AI 模型之前進行安全評估提供了一種方法。它作為專門針對 AI 系統的滲透測試工具,識別可能在生產環境中被利用的越獄及其他安全缺陷等漏洞。

工作原理

該應用程式基於 Ruby on Rails 構建,並由 NVIDIA garak 提供支持,會對目標 AI 系統運行一系列「探測器」(攻擊提示詞)。這些目標可以是基於 API 的 LLM 或基於瀏覽器的聊天介面。系統會追蹤攻擊成功率 (ASR),並提供關於哪些探測器成功繞過模型安全過濾器的詳細日誌與報告。

適用對象

需要針對已知攻擊向量驗證其 AI 系統安全性與魯棒性的安全團隊、AI 開發人員以及部署 LLM 的組織。

亮點

  • 廣泛的探測器庫:包含涵蓋 35 個漏洞家族的 179 個社群探測器,與 OWASP LLM Top 10 保持一致。

  • 真實世界的攻擊:內置了實際由 0DIN 公開的越獄手段以及每種攻擊的多種可重定向變體。

  • 企業級功能:支持多租戶部署、定期掃描和 SIEM 集成(Splunk 或 Rsyslog)。

  • 全面的報告:提供具有鑽取功能和攻擊成功率趨勢追蹤功能的 PDF 匯出。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案