boshu2/agentops

The operating loop a coding agent follows — and skills to orchestrate multi-agent systems.

解决的问题

AgentOps 通过解决四个关键问题来应对自主编程智能体的不可靠性:

  1. 自我评分偏差: 智能体经常在编写代码的同一个会话中宣布胜利。
  2. 共同盲点: 单一上下文可能会与作者共享相同的错误。
  3. 需求漂移: 如果没有固定的验收标准,智能体对“完成”的定义可能会在任务执行过程中发生变化。
  4. 缺乏可追溯性: 标准的聊天历史是瞬时的,难以审计。

工作原理

该项目实现了一个称为 RPI (Plan $ ightarrow$ Implement $ ightarrow$ Validate) 的结构化运行循环,作为技能在 Claude Code 或 Cursor 等现有编程智能体中运行。它使用 "Beads" 通过 BDD 和 DDD 在实现开始前锁定意图。为了确保完整性,validate 阶段在全新的上下文中运行(可能使用不同的模型),以发布 PASSFAILNOT_PROVEN 的判定。它还包括准入控制钩子,以防止智能体执行破坏性命令。

适用对象

  • 开发者: 使用 AI 编程助手(Claude Code, Codex, Cursor)并希望获得更可靠、可验证的代码生成的开发者。
  • AI 工程师: 构建多智能体系统,需要 swarmcouncil 等编排技能进行独立判定的工程师。
  • 团队: 需要通过持久判定来获得智能体工作可审计、内容寻址证据的团队。