SWE-agent/mini-swe-agent

The 100 line AI agent that solves GitHub issues or helps you in your command line. Radically simple, no huge configs, no giant monorepo—but scores >74% on SWE-bench verified!

解决的问题

mini-swe-agent 是一个最小化的 AI 软件工程代理,旨在作为可自定义、高性能的工具,而非复杂的黑箱。它消除了专用工具和复杂接口的开销,使语言模型能够直接与系统 shell 交互,解决软件工程任务。

如何工作

与传统代理不同,它采用极简化的架构:

  • 仅使用 Bash 交互:不使用工具调用接口;完全依赖语言模型使用 bash 命令执行操作的能力。
  • 线性历史记录:每个步骤都简单地追加到消息历史中,使执行轨迹易于调试和微调。
  • 独立执行:通过 subprocess.run 执行操作,意味着每个操作都是独立的,而非维护有状态的 shell 会话,这提高了稳定性并简化了沙箱化。
  • 广泛兼容性:通过 LiteLLM、OpenRouter 和 Portkey 支持多种模型,并可在本地环境或 Docker、Podman、Singularity 等沙箱中部署。

适用人群

  • 希望获得快速、简单的命令行工具用于 AI 辅助编码的 开发者
  • 进行微调(FT)或强化学习(RL)研究,需要一个不会过度依赖特定代理框架的基准系统的 研究人员
  • 寻求稳定且快速方式在 SWE-bench 上运行基准评估的 用户

主要亮点

  • 极简设计:核心代理类大约只有 100 行 Python 代码。
  • 高性能:在 SWE-bench 验证基准上得分超过 74%。
  • 灵活部署:支持本地环境、Docker、Podman、Singularity 等多种环境。
  • 模型无关:适用于任何支持 completion 或响应端点的模型。
  • 轨迹浏览器:包含一个用于可视化代理步骤的工具。

写过它的文章

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目