robonuggets/gauntlet-loop
Turn any goal into a short prompt that makes your agent set a real quality bar, run builder and critic pairs, compare blind, and loop until it wins.
它解决了什么问题
它通过用具体的外部质量标准替代模糊的评判标准,防止AI代理在达到‘足够好’时停止。它自动化生成一个严格的提示,强制代理反复进行构建和批评,直到输出在客观上优于某个具体且高质量的参考样本。
它如何工作
- 目标设定:用户提供一个目标(例如,着陆页或命令行工具)。
- 标准选择:该技能建议2-3个具体、可获取且可比较的真实世界示例(称为“标准”),作为质量基准。
- 提示生成:选定一个标准后,该技能生成一个简短、可直接粘贴的提示(约150字)。
- 执行循环:当粘贴到代理会话中时,代理将工作拆分为小块,并使用一个“构建者”和一个独立的“严苛批评者”代理。批评者对当前工作与参考标准进行盲评比较,循环执行,直到工作在比较中胜出。
适用人群
希望确保其代理工作流产出专业级结果而非平庸输出的开发者和AI代理高级用户。
特色亮点
- 盲评机制:使用具有全新上下文的独立批评者代理,在工作与标准之间进行盲评,选出胜者,避免了数值评分中常见的评分漂移问题。
- 具体标准:拒绝模糊的标准,转而采用命名明确、可获取且可比较的参考样本。
- 代理无关性:可与Claude Code的
/loop和ultracode功能配合使用,也可通过普通指令适配任何代理。 - 基于结果的退出机制:循环仅在工作胜出盲评或用户手动终止时结束。
相关
- 项目
- 项目
- 项目
- 项目
- 项目