robonuggets/gauntlet-loop

Turn any goal into a short prompt that makes your agent set a real quality bar, run builder and critic pairs, compare blind, and loop until it wins.

它解決的問題

它透過以具體的外部品質標準取代模糊的評估標準,防止 AI 代理停止在「足夠好」的狀態。它自動產生一個嚴謹的提示,強制代理不斷重複構建與批判的循環,直到輸出在客觀上優於特定且高品質的參考資料。

如何運作

  1. 目標設定:使用者提供一個目標(例如,著陸頁或 CLI 工具)。
  2. 標準選擇:該技能建議 2-3 個具體、可取得且可比較的現實世界範例(稱為「標準」),作為品質基準。
  3. 提示生成:選定標準後,該技能會生成一個簡短、可直接複製的提示(約 150 字)。
  4. 執行循環:將提示貼入代理會話後,代理會將工作拆分成小塊,並使用一個「建造者」和一個獨立的「嚴苛評論者」代理。評論者會在不知情的情況下,將當前工作與參考標準進行盲比對,循環進行,直到工作在比對中勝出。

適用對象

希望確保其代理工作流程產出專業級結果而非平庸輸出的開發者與高階使用者。

特色

  • 盲比對:使用具備全新上下文的獨立評論者代理,從工作與標準中選出勝者,避免常見於數值評分的分數漂移問題。
  • 具體標準:拒絕模糊的標準,改用命名明確、可取得且可比較的參考資料。
  • 代理無關:可與 Claude Code 功能(如 /loopultracode)搭配使用,但也可透過純文字指示適應任何代理。
  • 以結果為終止條件:循環僅在工作贏得盲比對或使用者手動中止時才結束。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案