pydantic/pydantic-ai-harness

Your agent's favorite harness, built on Pydantic AI

解決的問題

Pydantic AI Harness 提供了一個全面的「能力」程式庫,可將簡單的 AI 代理轉換為複雜且可長期運行的自主代理。它解決了代理隨著時間退化,或缺乏必要環境以執行複雜任務(如程式碼庫維護、深度網路研究或跨會話記憶管理)的問題。

工作原理

該程式庫基於一個稱為「能力」的基本概念運作——一種可獨立添加至任何 Pydantic AI 代理中的自包含代理行為單元,透過 capabilities=[...] 參數實現。這些能力是模組化且可組合的,開發者可選擇添加單一模組(如檔案系統或 shell),或使用預建的「哈尼絲」(如 CoderResearcher 堆疊),這些哈尼絲本身是多個能力的組合。

適用對象

使用 Pydantic AI 建構自主代理的開發者,需要其代理具備持久記憶、安全執行環境、規劃能力以及高階上下文管理功能,以處理複雜且無需人工干預的工作。

主要亮點

  • 預建代理堆疊:包含編碼代理(Coder)和研究代理(Researcher)的完整設定。
  • 執行環境:提供安全的檔案系統存取、允許清單的 shell 執行,以及透過 Modal 實現的隔離雲沙箱。
  • 上下文管理:提供工具結果清除、滑動視窗修剪和工具輸出限制等工具,防止上下文視窗膨脹。
  • 推理與委派:支援結構化任務規劃、子代理委派和動態工作流程,其中模型可協調其他代理。
  • 知識與記憶:實現持久化的命名空間筆記本、對話歷史的 BM25 搜尋,以及按需載入技能說明。
  • 安全與控制:包含輸入/輸出驗證、提示注入防護和令牌/美元預算的使用上限等防護機制。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案