boshu2/agentops

The operations layer for agentic engineering — portable skills and contracts connecting intent, agents, software factories, and independent judgment.

解决的问题

AgentOps 解决了在代理式工程中出现的「自我评分」问题,即同一个 AI 代理既负责编写代码,又自行宣布代码已完成且正确。通过将代码编写与独立判断分离,防止形式审查(rubber-stamping)和接受标准漂移,确保工作能基于原始意图,由全新且独立的上下文进行验证。

如何工作

AgentOps 作为一个操作层,可与现有的编码代理(如 Claude Code、Codex 或 Cursor)集成。它引入了一个确定性的判断步骤:由同一模型家族但处于新会话中的全新评审者来评估候选变更。该评审者基于一个证据契约,要求包含主体声明、变更路径的覆盖范围,以及不同的作者/验证者 ID,作出具有约束力的 PASSFAILNOT_PROVEN 判断。

它还提供一个可选的技能库(例如 plantestrefactorvalidate),供代理执行特定任务。同时包含一个确定性的 CLI(ao)用于检查和证据操作,并提供准入控制钩子以阻止破坏性命令的执行。

适用人群

专为构建代理式软件工厂或使用 AI 编码代理的开发者和工程师设计,他们需要严格、可验证且持久的代码质量与正确性证据。

主要亮点

  • 职责分离:将执行变更的代理与判断其结果的代理解耦。
  • 证据契约:使用外部存储中的内容寻址 verdict.v2 文件,创建持久且可重放的判断记录。
  • 技能库:提供涵盖研究、规划、实现和验证的模块化技能菜单。
  • 工厂无关性:支持多种软件工厂运行时,包括 Gas City 和 Agentic Coding Flywheel。
  • 确定性防护机制:内置策略分发器,防止代理执行已知的破坏性命令。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目