first-fluke/oh-my-agent
The multi-agent harness that checks the work: verifies agent runs by artifacts (stop-hook gates, independent judges, append-only event logs) across Claude Code, Codex, Cursor, and 10+ runtimes.
解决的问题
许多AI代理声称成功是基于其内部叙述,这可能具有误导性或自相矛盾。oh-my-agent通过实现一种机械验证系统来解决此问题,该系统检查实际的工件(如测试结果和文件),而不是信任代理的摘要,从而确保工作确实已完成并经过验证。
如何工作
该项目提供一个多代理框架,将专业代理(如后端、前端、QA)组织成一个虚拟工程团队。它使用多个机械门控来确保质量:
- 停止钩子门控:在特定脚本(如
typecheck或test)成功退出前,阻止会话结束。 - 防规避门控:验证特定工件(如计划JSON和QA结果文件)的存在,以确保工作流确实已运行。
- 独立裁判:启动具有全新上下文的独立代理,重新验证标准,避免受到实施者声明的偏见影响。
- 事件溯源状态:将每个决策和门控结果记录在追加只读的JSON日志中,以供审计。
它在多个代理运行时(Claude Code、Cursor、Codex等)之间共享单一真相源(.agents/ 目录),允许用户通过配置切换供应商。
适用人群
希望超越简单的基于聊天的AI编程,实施具有自动化验证和跨供应商灵活性的严格多代理工作流的开发者和工程团队。
主要亮点
- 角色化架构:专用于架构、数据库设计、前端、后端和安全的代理。
- 多供应商支持:支持多种AI运行时,包括Claude Code、Cursor和Qwen Code。
- 机械验证:使用硬退出和文件检查,而非基于LLM的“看起来正确”评估。
- 令牌效率:采用双层技能加载系统,减少上下文窗口使用。
- 单体仓库感知:自动检测并路由代理到pnpm、nx、turbo或lerna项目中的特定工作区。
相关
- 项目
- 项目
- 项目
- 项目