boshu2/agentops

The operations layer for agentic engineering — portable skills and contracts connecting intent, agents, software factories, and independent judgment.

解決する課題

AgentOpsは、AIエージェントがコードを書くだけでなく、そのコードが完了・正しいと自ら宣言する『自己評価』の問題を解決します。コードの作成者と独立した判断を分離することで、承認のゆらぎや形式的な承認(ラバースタンピング)を防ぎ、元の意図に忠実な検証を、新たな独立した文脈で保証します。

動作方法

AgentOpsは、Claude Code、Codex、Cursorなどの既存のコーディングエージェントと統合できるオペレーション層です。決定論的な判断ステップを導入し、同じモデルファミリーだが新しいセッションからの新規レビュアーが候補となる変更を評価します。このレビュアーは、主語マニフェスト、変更されたパスのカバレッジ、および異なる著者/検証者IDを要件とする証拠契約に基づき、PASSFAILNOT_PROVEN の決定的な判断を下します。

また、エージェントが特定のタスクを実行できるように、オプションのスキルライブラリ(例:plantestrefactorvalidate)を提供します。決定論的なCLI(ao)を用いてチェックや証拠操作を実行でき、破壊的なコマンドをブロックするアドミッションコントロールフックも備えています。

対象ユーザー

エージェント型ソフトウェア工場を構築している開発者や、AIコーディングエージェントを使用しているが、コード品質と正しさに関する厳密で検証可能かつ持続可能な証拠を必要とするエンジニア向けです。

主な特徴

  • 責任の分離:変更の実装者と判断者を明確に分離。
  • 証拠契約:外部ストレージにコンテンツアドレス付きの verdict.v2 ファイルを用いて、再実行可能で持続可能な判断記録を構築。
  • スキルライブラリ:調査、計画、実装、検証に向けたモジュール式のスキルメニュー。
  • 工場非依存:Gas CityやAgentic Coding Flywheelなど、さまざまなソフトウェア工場ランタイムをサポート。
  • 決定論的ガードレール:既知の破壊的コマンドの実行を防ぐポリシー・ディスパッチャーを内蔵。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト