boshu2/agentops
The operations layer for agentic engineering — portable skills and contracts connecting intent, agents, software factories, and independent judgment.
解决的问题
AgentOps 解决了在代理式工程中出现的「自我评分」问题,即同一个 AI 代理既负责编写代码,又自行宣布代码已完成且正确。通过将代码编写与独立判断分离,防止形式审查(rubber-stamping)和接受标准漂移,确保工作能基于原始意图,由全新且独立的上下文进行验证。
如何工作
AgentOps 作为一个操作层,可与现有的编码代理(如 Claude Code、Codex 或 Cursor)集成。它引入了一个确定性的判断步骤:由同一模型家族但处于新会话中的全新评审者来评估候选变更。该评审者基于一个证据契约,要求包含主体声明、变更路径的覆盖范围,以及不同的作者/验证者 ID,作出具有约束力的 PASS、FAIL 或 NOT_PROVEN 判断。
它还提供一个可选的技能库(例如 plan、test、refactor、validate),供代理执行特定任务。同时包含一个确定性的 CLI(ao)用于检查和证据操作,并提供准入控制钩子以阻止破坏性命令的执行。
适用人群
专为构建代理式软件工厂或使用 AI 编码代理的开发者和工程师设计,他们需要严格、可验证且持久的代码质量与正确性证据。
主要亮点
- 职责分离:将执行变更的代理与判断其结果的代理解耦。
- 证据契约:使用外部存储中的内容寻址
verdict.v2文件,创建持久且可重放的判断记录。 - 技能库:提供涵盖研究、规划、实现和验证的模块化技能菜单。
- 工厂无关性:支持多种软件工厂运行时,包括 Gas City 和 Agentic Coding Flywheel。
- 确定性防护机制:内置策略分发器,防止代理执行已知的破坏性命令。
相关
- 项目
- 项目
- 项目
- 项目
- 项目