pydantic/pydantic-ai-harness

Your agent's favorite harness, built on Pydantic AI

何を解決するか

Pydantic AI Harness は、単純なAIエージェントを高度で長期間実行可能な自律エージェントに変換するための包括的な「機能」ライブラリを提供します。エージェントの時間経過による劣化や、コードベースのメンテナンス、深層ウェブ調査、セッション間記憶管理などの複雑なタスクを実行するための必要な環境が欠如する問題を解決します。

動作方法

このライブラリは「機能」と呼ばれる基本的なコンセプトに基づいて動作します。機能とは、capabilities=[...] 引数を介して任意の Pydantic AI エージェントに追加可能な自己完結型のエージェント行動単位です。これらの機能はモジュール式かつ合成可能であり、ファイルシステムやシェルといった個別のブロックを簡単に追加できるほか、CoderResearcher スタックといった事前構築済みの「ハーネス」も利用可能です。これらは複数の機能の組み合わせで構成されています。

対象ユーザー

Pydantic AI を使って自律エージェントを開発する開発者で、エージェントに永続的な記憶、セキュアな実行環境、計画能力、高度なコンテキスト管理機能を備えさせ、複雑な未監視作業を処理できるようにしたい方。

主な特徴

  • 事前構築されたエージェントスタック: コーディングエージェント(Coder)および調査エージェント(Researcher)用の完全な設定を含む。
  • 実行環境: セキュアなファイルシステムアクセス、許可リストによるシェル実行、Modal を通じた隔離されたクラウドサンドボックスを提供。
  • コンテキスト管理: ツールの結果クリア、スライディングウィンドウのトリミング、ツール出力の制限など、コンテキストウィンドウの肥大化を防ぐためのツールを備える。
  • 推論と委任: 構造化されたタスク計画、サブエージェントへの委任、モデルが他のエージェントをオーケストレーションする動的ワークフローをサポート。
  • 知識と記憶: 永続的な名前空間付きノートブック、会話履歴に対する BM25 検索、オンデマンドでのスキル手順の読み込みを実装。
  • セキュリティと制御: 入出力の検証、プロンプトインジェクション防御、トークン/USD バジェットに対する使用制限などのガードレールを備える。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト