boshu2/agentops
The operating loop a coding agent follows — and skills to orchestrate multi-agent systems.
解決する課題
AgentOpsは、以下の4つの主要な問題を解決することで、自律的なコーディングエージェントの信頼性の低さに対処します。
- 自己採点バイアス: エージェントは、コードを書いたのと同じセッション内で勝利を宣言してしまうことがよくあります。
- 共有された盲点: 単一のコンテキストでは、作成者と同じエラーを共有してしまう可能性があります。
- 要件のドリフト: 固定された受け入れ基準がないと、エージェントの「完了」の定義がタスクの途中で変わってしまう可能性があります。
- トレーサビリティの欠如: 標準的なチャット履歴は一時的であり、監査が困難です。
仕組み
このプロジェクトは、RPI (Plan $
ightarrow$ Implement $
ightarrow$ Validate) として知られる構造化されたオペレーティングループを実装しており、Claude CodeやCursorなどの既存のコーディングエージェント内でスキルとして動作します。実装を開始する前に、BDDおよびDDDを介して意図を固定するために「Beads」を使用します。整合性を確保するために、validate フェーズは新しいコンテキスト(別のモデルを使用する可能性があります)で実行され、PASS、FAIL、または NOT_PROVEN の判定を下します。また、エージェントが破壊的なコマンドを実行するのを防ぐためのアドミッションコントロールフックも含まれています。
対象者
- 開発者: より信頼性が高く、検証可能なコード生成を求める、AIコーディングアシスタント(Claude Code, Codex, Cursor)の利用者。
- AIエンジニア: 独立した判定のために
swarmやcouncilのようなオーケストレーションスキルを必要とする、マルチエージェントシステムを構築しているエンジニア。 - チーム: 永続的な判定を通じて、エージェントの作業の監査可能な、コンテンツベースの証拠を必要とするチーム。