SWE-agent/mini-swe-agent
The 100 line AI agent that solves GitHub issues or helps you in your command line. Radically simple, no huge configs, no giant monorepo—but scores >74% on SWE-bench verified!
해결하는 문제
mini-swe-agent는 복잡한 블랙박스가 아니라, 해킹이 가능하고 고성능인 도구로 설계된 최소한의 AI 소프트웨어 엔지니어링 에이전트입니다. 전용 도구와 복잡한 인터페이스의 오버헤드를 제거하여 언어 모델이 시스템 셸과 직접 상호작용하여 소프트웨어 엔지니어링 작업을 해결할 수 있도록 합니다.
작동 방식
전통적인 에이전트와 달리, 극도로 단순화된 아키텍처를 사용합니다:
- Bash 전용 상호작용: 도구 호출 인터페이스를 사용하지 않으며, 언어 모델이 bash 명령어를 사용해 행동을 수행할 수 있는 능력에 완전히 의존합니다.
- 선형 기록: 모든 단계가 메시지 기록에 단순히 추가되므로, 실행 경로를 쉽게 디버깅하고 세부 조정할 수 있습니다.
- 독립적 실행:
subprocess.run을 통해 각 작업이 실행되므로, 상태를 유지하는 셸 세션을 유지하지 않고 독립적으로 실행되며, 이는 안정성을 높이고 사전 환경 설정을 단순화합니다. - 광범위한 호환성: LiteLLM, OpenRouter, Portkey를 통해 다양한 모델을 지원하며, 로컬 환경이나 Docker, Podman, Singularity 등의 사전 환경에서도 배포 가능합니다.
대상 사용자
- AI 보조 코딩을 위한 빠르고 간단한 명령줄 도구를 원하는 개발자.
- 파인튜닝(FT) 또는 강화학습(RL)을 수행하는 연구자로, 특정 에이전트 구조에 과적합되지 않는 기준 시스템이 필요한 분.
- SWE-bench에서 벤치마크 평가를 안정적이고 빠르게 수행하고자 하는 사용자.
주요 특징
- 최소한의 디자인: 핵심 에이전트 클래스는 약 100줄의 Python 코드로 구성됩니다.
- 고성능: SWE-bench 검증 벤치마크에서 74% 이상의 점수를 기록합니다.
- 유연한 배포: 로컬 환경, Docker, Podman, Singularity 등 다양한 환경에서 지원합니다.
- 모델 독립성: 완성 또는 응답 엔드포인트를 지원하는 모든 모델과 호환됩니다.
- 트래잭터리 브라우저: 에이전트의 단계를 시각화하는 도구를 포함합니다.
이 프로젝트를 다룬 글
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트