lopopolo/harness-engineering

🐎 Ryan Lopopolo’s anthology, field guide, and agent context bundle for harness engineering

解決的問題

解決通用模型權重與組織私有且持續演進的流程資料之間的差距。雖然大語言模型具備能力,但缺乏執行特定組織任務所需的特定操作狀態、本地本體、品質標準和內部流程(「流程資料冰山」),而這些是員工可靠完成工作所必需的。

如何運作

不關注模型本身,而是將模型與編碼代理視為黑箱,專注於「Harness Engineering」——塑造代理周圍的環境。這透過以下方式實現:

  • 精選上下文與工具:為代理提供必要的外部控制手段,以恢復意圖並操作系統。
  • 編碼非功能需求:將可靠性、安全性、效能等品質屬性以及組織決策轉化為程式碼倉儲中可檢索的上下文、範例與可執行約束。
  • 累積判斷:建立反饋迴圈,將失敗、修正與使用者回應中的經驗教訓反饋至環境中,以改善未來的代理軌跡。
  • 最後一哩部署:確保在執行時,組織的上下文、能力與權限被提供給代理。

適用對象

使用編碼代理維護系統的組織與開發者,希望確保這些代理遵守特定組織標準、品質標準與內部營運知識。

特點

  • 以環境為中心:透過塑造環境而非修改模型來提升代理輸出。
  • 非功能需求即程式碼:旨在將組織的所有約束納入程式碼中。
  • 累積一致性:使組織判斷具有累積性,確保代理維護的成果隨時間保持一致性。
  • 代理就緒文件:包含 AGENTS.md 檔案,用於引導代理存取相關參數、案例與證明。

相關