pydantic/pydantic-ai-harness

Your agent's favorite harness, built on Pydantic AI

解决的问题

Pydantic AI Harness 提供了一个全面的「能力」库,可将简单的 AI 代理转变为复杂且可长期运行的自主代理。它解决了代理随时间退化或缺乏必要环境以执行复杂任务(如代码库维护、深度网络研究或跨会话记忆管理)的问题。

工作原理

该库基于一个称为「能力」的基本概念运行——一种可独立添加到任何 Pydantic AI 代理中的自包含代理行为单元,通过 capabilities=[...] 参数实现。这些能力是模块化且可组合的,开发者既可以添加单个模块(如文件系统或 shell),也可以使用预构建的「哈尼丝」(如 CoderResearcher 堆栈),这些哈尼丝本身是多个能力的组合。

适用人群

使用 Pydantic AI 构建自主代理的开发者,需要其代理具备持久记忆、安全执行环境、规划能力以及高级上下文管理功能,以处理复杂且无需人工干预的工作。

主要亮点

  • 预构建代理堆栈:包含编码代理(Coder)和研究代理(Researcher)的完整配置。
  • 执行环境:提供安全的文件系统访问、允许列表的 shell 执行,以及通过 Modal 实现的隔离云沙箱。
  • 上下文管理:提供工具结果清除、滑动窗口修剪和工具输出限制等工具,防止上下文窗口膨胀。
  • 推理与委派:支持结构化任务规划、子代理委派和动态工作流,其中模型可协调其他代理。
  • 知识与记忆:实现持久化的命名空间笔记本、对话历史的 BM25 搜索,以及按需加载技能说明。
  • 安全与控制:包含输入/输出验证、提示注入防御和令牌/美元预算的使用限额等防护机制。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目