boshu2/agentops

The operating loop a coding agent follows — and skills to orchestrate multi-agent systems.

解決的問題

AgentOps 透過解決四個關鍵問題來應對自主程式碼代理的不可靠性:

  1. 自我評分偏差: 代理經常在編寫程式碼的同一個對話階段中宣布勝利。
  2. 共同盲點: 單一上下文可能會與作者共享相同的錯誤。
  3. 需求漂移: 如果沒有固定的驗收標準,代理對「完成」的定義可能會在任務執行過程中發生變化。
  4. 缺乏可追溯性: 標準的對話歷史是瞬時的,難以審計。

工作原理

本專案實作了一個稱為 RPI (Plan $ ightarrow$ Implement $ ightarrow$ Validate) 的結構化運行循環,作為技能在 Claude Code 或 Cursor 等現有程式碼代理中執行。它使用 "Beads" 透過 BDD 和 DDD 在實作開始前鎖定意圖。為了確保完整性,validate 階段會在全新的上下文中執行(可能使用不同的模型),以發布 PASSFAILNOT_PROVEN 的判定。它還包含准入控制鉤子,以防止代理執行破壞性指令。

適用對象

  • 開發者: 使用 AI 程式碼助手(Claude Code, Codex, Cursor)並希望獲得更可靠、可驗證程式碼生成的開發者。
  • AI 工程師: 正在構建多代理系統,需要 swarmcouncil 等編排技能進行獨立判定的工程師。
  • 團隊: 需要透過持久判定來獲得代理工作可審計、內容定址證據的團隊。