Q00/ouroboros

Agent OS: the agent gets smarter on its own. We just hold the line: the grading command and expected result never make it into the success contract we hand it. Interview-gated, staged evaluation, budgeted evolution loop. MCP server, 13 runtimes: Claude Code, Codex CLI, Gemini CLI, OpenCode, Copilot, Kiro and more.

解決する課題

Ouroborosは、AIコーディングにおける曖昧なプロンプトとアーキテクチャのドリフトという問題を解決します。アドホックなプロンプトを構造化されたスペックファーストのワークフローに置き換えることで、コードが書かれる前に人間の意図を明確にし、AIエージェントが推測によって複数のやり直しサイクルを必要とするのを防ぎます。

仕組み

Ouroborosは、ユーザーと様々なAIコーディングエージェント(Claude Code、Codex、GitHub Copilotなど)の間に位置する「Agent OS」またはランタイムレイヤーとして機能します。以下のサイクルを実装しています:

  1. インタビュー:隠れた前提を明らかにし、曖昧さスコアを計算するソクラテス式質問プロセス。
  2. シード:インタビューの結果を、受け入れ基準、オントロジー、制約を含む不変な仕様書として結晶化します。
  3. 実行:エージェントはSeedに基づいてタスクを実行します。
  4. 評価:3段階の自動評価ゲート(機械的、意味的、マルチモデルコンセンサス)が出力を検証します。
  5. 進化:プロセスは失敗に基づいて繰り返され、改善されます。

対象者

曖昧なアイデアを、手動でのプロンプトエンジニアリングや手動QAを絶えず行うことなく、検証済みの動作するコードベースに変換したいと考えている、AIコーディングエージェントを使用する開発者。

ハイライト

  • マルチランタイムサポート:Claude Code、Codex CLI、GitHub Copilot CLI、OpenCode、Geminiなど、幅広いエージェントで動作します。
  • Agent OSアーキテクチャ:Shell (TUI)、Apps (ドメインプラグイン)、およびSeedとLedgerを管理するOSコア (カーネル) に分割されています。
  • スペックファースト:実行開始前に不変のSeed仕様書を通じて意図をロックします。
  • 自動評価:「良さそう」な手動レビューを、構造化された3段階の検証ゲートに置き換えます。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト