secureagentics/Adrian

Open-source runtime AI agent security tool - monitors and controls AI agents, catching malicious tool use, prompt injection, and policy drift in real time, before the agent acts.

何を解決するか

Adrian は、AIエージェントの悪意あるまたは不整合な行動を防止するランタイムセキュリティレイヤーを提供します。静的解析やネットワーク監視の限界を補完し、プロンプトインジェクション、ジャイルブレイク、ツール汚染、データ漏洩、権限昇格など、従来の手法では検出されない攻撃を検出します。

動作方法

従来の監視がアクティビティログ(ツール呼び出しやAPIインタラクションなど)のみを確認するのに対し、Adrian はエージェントの実際の行動と内部の推論トレースの両方を分析します。エージェントが行動する『理由』を理解し、セッション全体にわたってその関連性を把握することで、訓練データに存在しなくてもエージェントが『範囲外』(例:ECエージェントがパスワードをリセットする)になる状況を検出できます。

対象ユーザー

LangChain、LangGraph、AnthropicのSDKなど、さまざまなフレームワークでAIエージェントを開発する開発者、およびClaude Codeのユーザーを対象としています。エージェントが定義された範囲内で動作することを保証したい人、クラウドダッシュボードによるマネージドデプロイまたは完全にセルフホスティングによるデータ主権を確保したい人向けです。

特徴

  • 推論を意識した監視: 行動分析と推論分析を統合し、行動のみの監視よりも洗練された攻撃を検出可能。
  • 実行中での干渉: リスクのある行動を実行前に一時停止し、人間による承認を待つことが可能。
  • 広範な統合: Python および TypeScript SDK をサポートし、Claude Code 用のネイティブプラグインと LangChain への対応も提供。
  • セルフホスティング対応: Docker を通じたフルスタックデプロイが可能。オフライン・データ主権環境向けに、Gemma 4 を Llama.cpp で利用するローカル分類モデルも提供。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト