s0ld13rr/pentestcode

PentestCode - Multi-agent AI penetration testing system with persistent engagement state, strategic coordination, and parallel autonomous operations.

何を解決するか

PentestCodeは、ペネトレーションテストの複雑で繰り返しのプロセスを自動化します。手動でセキュリティツールを実行し、出力を解析して次のステップを決定するサイクルを、初期スキャンからドメイン管理者権限の取得までを実行できる自律型エージェントに置き換えます。すべての発見を構造化された記録として保持します。

動作方法

このシステムは、13の専門エージェントからなる戦略家・調整者アーキテクチャを使用しています。リーダーエージェントがエンゲージメントを計画し、サブエージェント(リコン、スキャナー、エクスプロイター、アイデンティティエージェントなど)にタスクを割り当て、並列で作業を行います。

これらのエージェントは中央集権的な「エンゲージメント状態」を共有しており、ホスト、サービス、脆弱性、資格情報、ネットワーク関係を追跡する構造化されたメモリです。この状態により、DijkstraやYenのアルゴリズムを用いたコストベースの攻撃パス探索などの複雑な操作が可能になり、1つのエージェントの発見が他のエージェントに即座に利用できます。20以上のLLMプロバイダと統合されており、nmapやsqlmapなどのツール出力を正しく共有状態に取り込むために専用のパーサーツールを使用しています。

対象ユーザー

  • ペネトレーションテスター:リコンからレポート作成までの完全なメソッドロジーを自動化。
  • CTFプレイヤー:フラグの追跡と複数ターゲットの調整。
  • バグバウンティハンター:WebアプリおよびAPIセキュリティのリコンを自動化。
  • セキュリティ研究者:体系的な列挙と脆弱性の検証。

特徴

  • マルチエージェントアーキテクチャ:リーダー戦略家と12の専門エージェントを使用し、並列実行を実現。
  • 共有エンゲージメント状態:ネットワークトポロジー、資格情報、攻撃パスを永続的かつクエリ可能なデータベースとして維持。
  • 広範なツール統合:nmap、nuclei、bloodhoundなど、18の組み込みツールと専用パーサーを搭載。
  • 柔軟な実行モードauto(自律)、free(直接リクエスト)、guided(ステップバイステップの承認)のモードを提供。
  • 知識パック:LLMコンテキストを肥大化させずに、ドメイン固有の知識をオンデマンドで提供する「スキル」(markdownファイル)を使用。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト