chAng-L19/codex-redteam-mode
针对于红队攻击思维做出的red team模式(破限项目,封号概不负责)##可自行适配其他Agent。项目问题请提issue
何を解決するか
このプロジェクトは、AIアシスタントにおける長時間実行されるセキュリティワークフローの不安定性に対処します。セッションの中断、ツールのばらつき、手動での結果の再送信、および「偽の完了」(ツールが成功を報告しても実際の目的が達成されていない状態)といった問題を防止します。
仕組み
Codex AppおよびCLI向けの耐久性のあるレッドチームランタイムを実装しています。システムはユーザーの目的を GoalContract に変換し、Model Context Protocol (MCP) ツールを使用して WorkflowSpec グラフで実行します。すべての基準が検証済みの証拠で証明された後、TerminalJudge がタスクを完了とマークします。安定性を維持するために、SQLite WAL を状態管理に使用し、同時実行制御にはイデムポテンシー・キーを採用。モデルに到達する前にリクエストを精査するための2層構造のプロンプト再書き換えシステムも採用しています。
対象ユーザー
複雑なマルチステップのセキュリティテストや脆弱性調査を自動化する必要がある、セキュリティ研究者やレッドチーム担当者。
特徴
- 耐久性のある実行: SQLite と独立した実行IDを使用し、復旧とバッチの自律性をサポート。
- 証拠に基づく完了: 終端ジャッジを満たすには、意味的に検証された結果と再現証明が必要。
- MCPツール統合: stdio または Streamable HTTP MCP を通じてツールを発見・連携。
- オプトイン起動: デフォルトで「通常モード」を維持し、レッドチーム操作に入るには明示的なコマンドが必要。
- プロンプト再書き換えプロキシ: モデルに送信する前のリクエストを改善するためのオプションのループバックプロキシ。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- Dispatch