asklokesh/loki-mode
Multi-agent autonomous SDLC framework. Spec to deployed app. PRD, GitHub issue, OpenAPI/JSON/YAML, or one-line brief. 5 AI providers, 8 quality gates.
Loki Mode – 自律的、仕様駆動型のコーディングアシスタント
何であるか – Loki Mode は、製品仕様(1行のアイデア、PRDファイル、OpenAPI仕様など)を入力すると、要求されたソフトウェアの完全な自動ビルドを実行する CLI/SDK ツールです。このツールは 検証完了 ワークフローに基づいて構築されており、生成されたコードが仕様を満たし、テストを通過し、ビルドされ、(オプションで)ランタイムヘルスチェックも通過することを決定論的チェックで証明できるまで、エージェントが実行されます。その証明は、後で監査可能な署名付き「証拠レシート」として保存されます。
動作方法 –
- 仕様を提供します。Loki はその複雑さを分類し、スターター・テンプレートを選択します。
- オーケストレーターが 8 分野にまたがる 41 の専門的エージェント役割のチームを構成し、RARV ループ(Reason → Act → Reflect → Verify)を実行します。8 つの組み込み品質ゲートチェック(テスト、ビルド、静的解析、シークレットスキャン、ランタイムヘルスなど)を実施します。
- エージェントは Anthropic の Claude モデル(または互換性のある任意の LLM)上で実行され、実行中にモデルを切り替えることも可能です。
- すべてのゲートが通過すると、Loki は生成されたリポジトリと機械検証可能なレシート(
.loki/proofs/<run_id>/)を出力。このレシートには差分のハッシュ、テスト/ビルド結果、GPG署名付きの証明が含まれます。
主なコマンド
| コマンド | 目的 |
|---|---|
loki quickstart "<idea>" --yes |
短いアイデアからワンショットビルド。テンプレートを選択し、コスト/時間見積もりを表示した後、追加のプロンプトなしでビルドを実行。 |
loki start <spec.md> |
あなたが作成した完全な仕様ファイルからビルド。 |
loki modernize heal <repo> --assess |
既存コードベースの読み取り専用分析。成熟度評価、技術的負債の兆候、低リスク改善ターゲットのランク付けリストを提供。 |
loki proof verify <id> |
レシートを再ハッシュし、差分が一致することを確認。クリーンな検証で exit 0 を返す。 |
loki doctor |
必要な環境変数(例: ANTHROPIC_API_KEY)や依存関係が存在するかを確認。 |
loki quickstart --dry-run --json > preview.json |
ファイルの書き込みやモデルの呼び出しを行わずに、決定論的なプランのプレビュー(テンプレート選択、コスト見積もり、仕様ハッシュ)を生成。 |
loki verify |
任意のブランチ/PRの差分に対して、Loki の品質ゲートチェックを実行。CIフレンドリーな終了コード(0 = 検証済み、1 = 問題あり、2 = ブロック済み)を返す。 |
インストール – このプロジェクトは複数のチャネルを通じて Node ベースの CLI を配布しています。推奨方法は bun install -g loki-mode(起動が高速)。npm、Homebrew、Docker イメージも提供されています。Claude の IDE 統合に /loki-grill、/loki-spec-status、/loki-verify という Claude Code プラグインを追加可能です。
「検証完了」が重要な理由 – 多くのローカルコーディングエージェントは、実際には変更を加えておらず、テストが失敗したまま「完了」と主張します。Loki は以下の条件がすべて満たされない限り、実行を完了と見なしません:
- git diff が空でない。
- 必須テストがすべて通過(実際の
N passed出力)。 - ビルドが成功。
- オプションのゲート(ランタイムヘルス、シークレット漏洩検出)が通過。
いずれかのゲートが不確実な場合、レシートには ギャップ(例:
VERIFIED WITH GAPS)が記録されます。レシートは正確な差分ハッシュに紐づけられたプレーンファイルであり、エージェントの自己報告を信頼せずに、誰でも再検証できるように設計されています。
証拠レシート – 各実行は .loki/proofs/ の下にディレクトリを作成し、以下の内容を含みます:
- 生成された変更の
diff_sha256。 - テスト、ビルド、ゲートの結果。
- AI生成の「評議会の判断」(評価 とマークされ、証明ではない)。
- オプションで分離された GPG署名(
LOKI_PROOF_GPG_KEY)。 見出し(VERIFIED、VERIFIED WITH GAPS、またはNOT VERIFIED)は 決定論的 な事実からのみ導出されます。
利用例
- 迅速なプロトタイピング – 1つのコマンドで、短いアイデアを実行可能なフルスタックアプリ(Docker-composeを含む)に変換。
- レガシーの近代化 – 既存リポジトリに対して読み取り専用の評価を実行し、優先順位付けされた低リスク変更リストを得た後、厳格な検証のもとでLokiが変更を適用。
- CI統合 –
loki verifyをパイプラインで使用し、PRが自律エージェントが使用する品質ゲートを満たしていることを強制。 - 監査可能なAI生成コード – レシートをプルリクエストに添付。レビュアーは差分とテスト結果を独立して検証可能。
制限 / 注意点
- 実行には Anthropic API キー(または互換性のあるLLM)が必要。モデルがなければ、プレビューのみ表示可能。
- 「検証済み」という主張の信頼性は決定論的チェックの強さに依存。悪意ある攻撃者が事実とレシートの両方を書き換えることで一貫性を保つ可能性があるため、高信頼なシナリオでは署名付きレシートを推奨。
- 現在、CLI は標準で Claude ベースのプロバイダーのみをサポート。他のモデルはカスタム統合が必要。
- ツールはオープンソースですが、商用版(Autonomi Cloud/Enterprise)ではチームレベルの機能が追加。無料版には一部のエンタープライズグレードのオーケストレーションやUIコンポーネントが欠けている可能性あり。
結論 – Loki Mode は本物のオープンソース自律コーディングエージェントであり、検証を通じた信頼 を重視しています。仕様からコードへのパイプラインを完全自動化し、何をしたかを決定論的に証明する証拠を提供。スクリプトやCI環境で安全に使用可能なコマンドセットを備えています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト