AISecurityLab/hackagent
HackAgent is an open-source security toolkit to detect vulnerabilities of your AI Agents
What it solves
HackAgentは、AIエージェントの脆弱性を発見するために設計されたセキュリティ・レッドチーミング・ツールキットです。従来のセキュリティツールでは検出できない、プロンプトインジェクション、ジェイルブレイク、ゴールハイジャック、およびツールの誤用といったリスクに対処します。
How it works
これは、さまざまな研究に基づいた攻撃手法(PAIR、TAP、およびAutoDAN-Turboなど)をオーケストレートするAttack Engine、敵対的プロンプトを作成するGenerator LLM、および安全対策が回避されたかどうかを評価するJudge LLMで構成されるモジュール式パイプラインを使用します。このプロセスは、LangChain、OpenAI SDK、LiteLLM、およびGoogle ADKのようなフレームワーク上に構築されたターゲットエージェントをテストするために自動化されています。
Who it’s for
AIエージェントの堅牢性を評価し、強化する必要があるセキュリティ研究者、開発者、およびAIセーフティ・プラクティショナーです。
Highlights
- Automated Red-Teaming: さまざまな高度な攻撃手法を使用して、セキュリティ上の欠陥の発見を自動化します。
- Broad Framework Support: LangChainやOpenAI SDKを含む主要なAIエージェント・フレームワークと互換性があります。
- Flexible Reporting: ローカルのSQLiteベースのダッシュボードと、クラウドベースのレポートプラットフォームの両方を提供します。
- Easy Deployment: Python SDK、CLI、または複数のプラットフォーム向けのスタンドアロン・バイナリとして利用可能です。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト