boshu2/agentops
The operating loop a coding agent follows — and skills to orchestrate multi-agent systems.
解决的问题
AgentOps 通过解决四个关键问题来应对自主编程智能体的不可靠性:
- 自我评分偏差: 智能体经常在编写代码的同一个会话中宣布胜利。
- 共同盲点: 单一上下文可能会与作者共享相同的错误。
- 需求漂移: 如果没有固定的验收标准,智能体对“完成”的定义可能会在任务执行过程中发生变化。
- 缺乏可追溯性: 标准的聊天历史是瞬时的,难以审计。
工作原理
该项目实现了一个称为 RPI (Plan $
ightarrow$ Implement $
ightarrow$ Validate) 的结构化运行循环,作为技能在 Claude Code 或 Cursor 等现有编程智能体中运行。它使用 "Beads" 通过 BDD 和 DDD 在实现开始前锁定意图。为了确保完整性,validate 阶段在全新的上下文中运行(可能使用不同的模型),以发布 PASS、FAIL 或 NOT_PROVEN 的判定。它还包括准入控制钩子,以防止智能体执行破坏性命令。
适用对象
- 开发者: 使用 AI 编程助手(Claude Code, Codex, Cursor)并希望获得更可靠、可验证的代码生成的开发者。
- AI 工程师: 构建多智能体系统,需要
swarm或council等编排技能进行独立判定的工程师。 - 团队: 需要通过持久判定来获得智能体工作可审计、内容寻址证据的团队。