first-fluke/oh-my-agent
The multi-agent harness that checks the work: verifies agent runs by artifacts (stop-hook gates, independent judges, append-only event logs) across Claude Code, Codex, Cursor, and 10+ runtimes.
解決的問題
許多AI代理聲稱成功是基於其內部敘述,這可能具有誤導性或自相矛盾。oh-my-agent透過實現機械式驗證系統來解決此問題,該系統檢查實際的工件(如測試結果和檔案),而非信任代理的摘要,從而確保工作確實已完成並經過驗證。
如何運作
此專案提供一個多代理框架,將專業代理(如後端、前端、QA)組織成虛擬工程團隊。它使用多個機械式門控來確保品質:
- 停止鈎子門控:在特定腳本(如
typecheck或test)成功退出前,阻止會話結束。 - 防迴避門控:驗證特定工件(如計畫JSON和QA結果檔案)的存在,以確保工作流程確實已執行。
- 獨立審判:啟動具有全新上下文的獨立代理,重新驗證標準,避免受到實施者聲明的偏見影響。
- 事件溯源狀態:將每個決策和門控結果記錄在追加只讀的JSON日誌中,以供審計。
它在多個代理執行環境(Claude Code、Cursor、Codex等)之間共享單一真相來源(.agents/ 目錄),允許使用者透過設定切換供應商。
適用對象
希望超越簡單的聊天式AI程式設計,實施具備自動驗證與跨供應商彈性的嚴謹多代理工作流程的開發者與工程團隊。
主要亮點
- 角色化架構:專用於架構、資料庫設計、前端、後端和安全的代理。
- 多供應商支援:支援多種AI執行環境,包括Claude Code、Cursor和Qwen Code。
- 機械式驗證:使用硬退出和檔案檢查,而非基於LLM的「看起來正確」評估。
- 令牌效率:採用雙層技能載入系統,減少上下文視窗使用。
- 單體倉儲感知:自動偵測並路由代理至pnpm、nx、turbo或lerna專案中的特定工作區。
相關
- 專案
- 專案
- 專案
- 專案