alinaqi/maggy

What started as an opinionated Claude Code setup kit is now an autonomous AI engineering command center

何を解決するか

Claude Code は強力ですが、しばしば単純なタスクに高コストのモデルを使用し、セッション間で状態を失い、コード品質、テストカバレッジ、アーキテクチャ準拠に対する強制がありません。Maggy とその Bootstrap コンフィグパックは、TDD の強制、永続的メモリ、コスト意識のあるモデルルーティングを AI コーディングワークフローに追加する構造化されたエンジニアリングシステムを提供します。

動作方法

このプロジェクトは2つの主要なコンポーネントで構成されています:

  1. Claude Bootstrap:Claude Code 設定に直接インストールされるスキル、フック、ルールのセット。品質ゲート(例:関数長の上限)と TDD(タスクが完了とマークされる前にテストが成功する必要がある)を強制します。
  2. Maggy Harness:ローカルの FastAPI サーバーと Web ダッシュボード。Bootstrap を拡張し、高度な機能を提供します。13種類の異なる LLM タイア(ローカルの Qwen3 から Claude Opus まで)にリクエストをルーティングするための意味的「ブレースコア」を使用し、コストと能力の最適化を図ります。また、「Polyphony」により、Docker コンテナで隔離された複数のエージェントを並列実行し、ファイルの競合を防ぎます。

対象ユーザー

  • 既存の Claude Code ワークフローを変更せずに、自動 TDD と永続的メモリを求めるシングルエンジニア。
  • 複数のモデル(Claude、DeepSeek、Gemini など)間で作業をルーティングし、コストを管理したいチーム。
  • 意図追跡とプラグインベースの AI 開発者ツールのリファレンス実装を探しているプラットフォームエンジニア。

主な特徴

  • 13段階モデルルーティング:タスクの複雑さに基づき、最も安価で十分な能力を持つモデルを自動選択。
  • TDD と品質ゲート:テストの成功とアーキテクチャルルール(例:1関数あたり最大20行)のハードな強制。
  • Polyphony:Docker で隔離された並列エージェント実行により、複数のエージェントが同じリポジトリで競合せずに作業可能。
  • Cortex MCP:AST の抽出と SQLite グラフストアを介した双方向走査を提供するコードインテリジェンスサーバー。
  • Telos:テストが通るだけでなく、コードが元の意図を実際に満たしているかを測る「意図忠実度スコアリング」システム。
  • Mnemos と Engram:複数次元のメモリシステムで、アーキテクチャ知識とタスク状態をセッション間で永続化。

関連

  • プロジェクト
  • Dispatch
  • プロジェクト
  • プロジェクト
  • Dispatch