SWE-agent/mini-swe-agent

The 100 line AI agent that solves GitHub issues or helps you in your command line. Radically simple, no huge configs, no giant monorepo—but scores >74% on SWE-bench verified!

解決する問題

mini-swe-agent は、複雑なブラックボックスではなく、ハック可能で高性能なツールとして設計された最小限の AI ソフトウェアエンジニアリングエージェントです。専用ツールや複雑なインターフェースのオーバーヘッドを排除し、言語モデルがシステムシェルと直接対話してソフトウェアエンジニアリングタスクを解決できるようにします。

動作方法

従来のエージェントとは異なり、極めて簡素化されたアーキテクチャを使用しています:

  • Bashのみの対話: ツールコールインターフェースは使用せず、言語モデルがbashコマンドを使用して行動を実行する能力に完全に依存します。
  • 線形履歴: すべてのステップがメッセージ履歴に単純に追加されるため、実行経路のデバッグや微調整が容易です。
  • 独立した実行: subprocess.run を通じて各アクションが実行されるため、状態を持つシェルセッションを維持するのではなく、各アクションは独立しています。これにより安定性が向上し、サンドボックス化も簡素化されます。
  • 広範な互換性: LiteLLM、OpenRouter、Portkey を通じてさまざまなモデルをサポートし、ローカル環境や Docker、Podman、Singularity などのサンドボックスでもデプロイ可能です。

対象ユーザー

  • AI補助コーディング用の高速でシンプルなコマンドラインツールを求める開発者
  • ファインチューニング(FT)や強化学習(RL)を行う研究者で、特定のエージェント枠組みに過剰適合しない基準システムが必要な方。
  • SWE-bench でのベンチマーク評価を安定かつ高速に実行したいユーザー

特徴

  • ミニマリスト設計: コアエージェントクラスは Python で約100行です。
  • 高いパフォーマンス: SWE-bench で検証されたベンチマークで74%以上のスコアを達成。
  • 柔軟なデプロイ: ローカル環境、Docker、Podman、Singularity などに対応。
  • モデル非依存: コンプリートまたはレスポンスエンドポイントをサポートする任意のモデルと連携可能。
  • トラジェクトリーブラウザ: エージェントのステップを可視化するツールを内蔵しています。

これを取り上げた記事

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト