first-fluke/oh-my-agent

The multi-agent harness that checks the work: verifies agent runs by artifacts (stop-hook gates, independent judges, append-only event logs) across Claude Code, Codex, Cursor, and 10+ runtimes.

何を解決するか

多くのAIエージェントは、内部の物語に基づいて成功を主張するが、これは誤解を招くか、矛盾している可能性がある。oh-my-agentは、エージェントの要約ではなく、実際のアーティファクト(テスト結果やファイルなど)をチェックする機械的検証システムを実装することで、作業が実際に完了され、検証されていることを保証する。

動作方法

このプロジェクトは、専門的なエージェント(例:バックエンド、フロントエンド、QA)を仮想的なエンジニアリングチームに組織するマルチエージェントハーネスを提供する。品質を確保するために、いくつかの機械的ゲートを使用する:

  • ストップフックゲート:特定のスクリプト(例:typechecktest)が正常に終了するまで、セッションを終了させない。
  • 回避防止ゲート:プランのJSONやQA結果ファイルなどの特定のアーティファクトの存在を検証し、ワークフローが実際に実行されたことを確認する。
  • 独立した審査員:実装者の主張に偏らないように、新規コンテキストで別個のエージェントを起動し、基準を再検証する。
  • イベントソースドステート:すべての意思決定とゲートの結果を追加のみ可能なJSONログに記録し、監査可能にする。

.agents/ ディレクトリという単一の真実のソースを、Claude Code、Cursor、Codexなどさまざまなエージェントランタイムにわたって共有し、設定でベンダーを切り替えることができる。

対象ユーザー

単純なチャットベースのAIコーディングから脱却し、自動検証と多ベンダー互換性を備えた厳格なマルチエージェントワークフローを実装したい開発者やエンジニアリングチーム。

特徴

  • 役割ベースのアーキテクチャ:アーキテクチャ、DB設計、フロントエンド、バックエンド、セキュリティ向けの専門エージェント。
  • 多ベンダー対応:Claude Code、Cursor、Qwen Codeなど複数のAIランタイムで動作。
  • 機械的検証:LLMによる「見た目は正しい」という評価ではなく、ハードエグジットとファイルチェックを使用。
  • トークン効率:コンテキストウィンドウの使用を削減するための2層構造のスキルロードシステムを実装。
  • モノレポ対応:pnpm、nx、turbo、lernaプロジェクトにおいて、自動的にワークスペースを検出し、エージェントにルーティングする。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト