PurpleAILAB/Decepticon
Autonomous Hacking Agent for Red Team
What it solves
Decepticon は、単なる脆弱性スキャンを超えることを目的とした自律型レッドチームエージェントです。偵察、エクスプロイト、権限昇格、横方向移動といった複雑でリアルな攻撃チェーンを自動化し、Rules of Engagement(RoE)や Operational Plans(OPPLAN)といったプロフェッショナルな交戦規則に従い、MITRE ATT&CK フレームワークにマッピングします。
How it works
システムは二層ネットワークアーキテクチャを採用し、管理プレーン(オーケストレーション、LLM、データベース)とサンドボックスプレーン(攻撃が実行される場所)を分離します。キルチェーンの各フェーズごとに編成された 16 人の専門エージェントチームを使用し、各エージェントはノイズを最小化するために新しいコンテキストウィンドウを持ちます。
主な技術的特徴は次のとおりです:
- Interactive Shell Support:永続的な tmux セッションでコマンドを実行し、プロンプト検出を自動化。
msfconsoleやsliver-clientなどのインタラクティブツールを使用可能です。 - Hardened Isolation:Docker ソケット経由で Kali Linux サンドボックス内で全てのアクションを実行します。
- Knowledge Persistence:Neo4j を使用して、エンゲージメント全体の知見をナレッジグラフとして保持します。
- Dynamic Workloads:オーケストレータを通じて、必要に応じて BloodHound CE、Ghidra MCP などの専門コンテナを起動します。
Who it’s for
プロフェッショナルなレッドチームメンバーやセキュリティ研究者向けに設計されており、複雑な攻撃作業の自動化や、シミュレート攻撃を通じて防御を検証し改善する「オフェンシブワクチン」ループの構築に役立ちます。
Highlights
- Professional Discipline:パケットを実行する前に RoE、ConOps、Deconfliction Plans を生成します。
- High Performance:全難易度レベルの XBOW バリデーションベンチマークで 98.08% の合格率を達成。
- Multi-Model Support:Anthropic、OpenAI、Google Gemini、Ollama 経由のローカルモデルなど、プロバイダーをサポートする階層型フォールバックチェーンを備えています。
- SDK Availability:Python ライブラリとして利用可能で、エージェントファクトリやツールを他の研究や製品に統合できます。