SWE-agent/mini-swe-agent

The 100 line AI agent that solves GitHub issues or helps you in your command line. Radically simple, no huge configs, no giant monorepo—but scores >74% on SWE-bench verified!

解決的問題

mini-swe-agent 是一個最小化的 AI 軟體工程代理,設計目標是作為一個可自訂、高效率的工具,而非複雜的黑箱。它移除了專用工具與複雜介面的額外負擔,讓語言模型能直接與系統 shell 互動,解決軟體工程任務。

如何運作

與傳統代理不同,它採用極度簡化的架構:

  • 僅使用 Bash 互動:不使用工具呼叫介面;完全依賴語言模型使用 bash 命令執行動作的能力。
  • 線性歷史記錄:每個步驟都簡單地追加到訊息歷史中,使執行軌跡容易調試與微調。
  • 獨立執行:透過 subprocess.run 執行動作,表示每個動作都是獨立的,而非維持有狀態的 shell 會話,這提升了穩定性並簡化了沙箱化。
  • 廣泛相容性:支援透過 LiteLLM、OpenRouter 和 Portkey 的多種模型,並可在本地環境或 Docker、Podman、Singularity 等沙箱中部署。

適用對象

  • 希望獲得快速、簡單命令列工具用於 AI 輔助編碼的 開發者
  • 進行微調(FT)或強化學習(RL)研究,需要一個不會過度依賴特定代理架構的基準系統的 研究人員
  • 尋求穩定且快速方式在 SWE-bench 上執行基準評估的 使用者

主要亮點

  • 極簡設計:核心代理類約僅 100 行 Python 程式碼。
  • 高效率:在 SWE-bench 驗證基準上得分超過 74%。
  • 彈性部署:支援本地環境、Docker、Podman、Singularity 等多種環境。
  • 模型無關:適用於任何支援 completion 或回應端點的模型。
  • 軌跡瀏覽器:內建可視化代理步驟的工具。

寫過它的文章

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案