boshu2/agentops

The operations layer for agentic engineering — portable skills and contracts connecting intent, agents, software factories, and independent judgment.

解決的問題

AgentOps 解決了代理式工程中的「自我評分」問題,即同一個 AI 代理既負責撰寫程式碼,又自行宣告程式碼已完成且正確。透過將程式碼撰寫與獨立判斷分離,防止形式審核(rubber-stamping)與接受標準漂移,確保工作能根據原始意圖,由全新且獨立的上下文進行驗證。

如何運作

AgentOps 作為一個操作層,可與現有的編碼代理(如 Claude Code、Codex 或 Cursor)整合。它引入一個決定性判斷步驟:由同一模型家族但處於新會話中的全新審查者來評估候選變更。該審查者基於一個證據契約,要求包含主體宣告、變更路徑的覆蓋範圍,以及不同的作者/驗證者 ID,作出具有約束力的 PASSFAILNOT_PROVEN 判斷。

它還提供一個可選的技能庫(例如 plantestrefactorvalidate),供代理執行特定任務。同時包含一個決定性 CLI(ao)用於檢查和證據操作,並提供准入控制鈎子以阻止破壞性命令的執行。

適用對象

專為構建代理式軟體工廠或使用 AI 編碼代理的開發者與工程師設計,他們需要嚴謹、可驗證且持久的程式碼品質與正確性證據。

主要亮點

  • 職責分離:將執行變更的代理與判斷其結果的代理解耦。
  • 證據契約:使用外部儲存中的內容尋址 verdict.v2 檔案,建立持久且可重播的判斷記錄。
  • 技能庫:提供涵蓋研究、規劃、實作和驗證的模組化技能選單。
  • 工廠無關性:支援多種軟體工廠執行時環境,包括 Gas City 和 Agentic Coding Flywheel。
  • 決定性防護機制:內建策略分發器,防止代理執行已知的破壞性命令。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案