Leonxlnx/unlazy

Anti-laziness skill for AI agents. Core: the Depth Tree method, which splits a task N layers deep and gives every leaf the full time budget of the whole task, so effort multiplies with depth. Grounded in 2025-2026 research on model laziness, underthinking and premature completion.

何を解決するか

大規模なソフトウェアエンジニアリングタスクにおいて、AIエージェントが「怠慢」になったり、部分的な遵守に留まったりする問題に対処します。タスクが完了したと見なされる前に、実行可能で証拠に基づいたゲート(検証ポイント)を検証することを要求することで、エージェントが実際には完了していないにもかかわらず、作業が完了したと主張することを防ぎます。

仕組み

このシステムは「ゲート契約」(Markdownによる台帳)を使用し、各要件は特定のシェルコマンド(CHECK:)と期待される出力(EXPECT:)とペアになっています。チェッカー・スクリプトがこれらのコマンドを実行し、実際の出力が期待値と一致するかを確認します。不正な実行を防ぐため、コマンドはユーザーによって承認される必要があります。また、このプロジェクトは、並列作業のためのスコープ付きパイプラインをサポートしており、エージェントが特定のファイルパスの所有権を主張することで書き込みの競合を回避できます。さらに、Claude Codeのようなツール向けに、すべてのゲートが満たされるまでセッションをブロックする「Stop hook」も備えています。

対象者

複雑で長期的なコーディングタスクにAIエージェント(Claude CodeやCodex CLIなど)を使用しており、依頼したリファクタリングや機能追加のすべての部分が実際に完了していることを保証するための厳格な方法を必要とする開発者。

ハイライト

  • 実行可能なゲート: 曖昧なAIの約束を、実行可能なシェルチェックと厳格な出力マッチングに置き換えます。
  • 証拠に基づいた検証: チェックと出力のSHA-256ダイジェストを生成し、要件の構造的なドリフトを検出します。
  • 並列コーディネーション: リポジトリの異なる部分を扱う複数のエージェントを管理するための、スコープ設定とリースの仕組みを提供します。
  • 統合フック: Claude Code向けに、エージェントがセッションを早期に終了させるのを防ぐための専用フックが含まれています。

これを取り上げた記事

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト