AtomicBot-ai/atomic-agent
Local First Ai Agent. Optimized for Local Ai models. Long context window. Proper tools callings. Runs privately on your device.
해결하는 문제
Atomic Agent는 클라우드 호스팅된 에이전트와 관련된 높은 비용, 지연, 개인정보 문제 없이 사용자 기계에서 복잡하고 다단계 작업을 수행할 수 있도록 설계된 로컬 우선 AI 에이전트입니다. 특히 대화 기록이 길어질수록 로컬 모델이 어려움을 겪는 '컨텍스트 과잉' 문제를 해결합니다. 이로 인해 시간이 지남에 따라 모델이 느려지고 효과가 떨어지는 현상을 방지합니다.
작동 방식
이 프로젝트는 LLM에 전송하는 데이터 양을 최소화하는 컨텍스트 효율적인 에이전트 루프를 구현합니다. 매번 전체 기록을 다시 전송하는 대신, 프롬프트, 결정, 실행, 압축의 과정을 거쳐 결과를 요약합니다.
소비자용 하드웨어에서 성능을 최적화하기 위해, KV 캐시 압축(최대 6.4배), Lloyd-Max 가중치 양자화, 그리고 Gemma 4 및 Qwen 3.6와 같은 모델을 위한 커스텀 스펙ulative 디코딩을 갖춘 커스텀 TurboQuant llama.cpp 백엔드를 사용합니다. 또한 GBNF 문법을 활용해 도구 호출이 항상 유효한 JSON 배열이 되도록 보장합니다.
대상 사용자
개발자 및 고급 사용자에게 적합하며, 데스크톱(브라우저, 파일 시스템, 쉘)을 제어하고 HTTP 또는 Tauri 사이드카를 통해 자체 애플리케이션과 통합할 수 있는 사생활 보호가 가능한 로컬 AI 어시스턴트를 원하는 분들입니다.
주요 특징
- 데스크톱 제어: Playwright를 통해 웹 탐색, 파일 편집, 승인된 쉘 명령어 실행, 클립보드 관리 가능.
- 로컬 우선 메모리: 프로필 정보, 에피소딕 노트, 학습 내용을 로컬 SQLite 저장소에 저장하고, 프롬프트에 삽입하는 대신 도구 호출을 통해 참조합니다.
- uma MCP 지원: 외부 Model Context Protocol (MCP) 서버에 연결하여 도구 레지스트리를 확장할 수 있습니다.
- 하드웨어 최적화: 소규모 양자화 모델을 소비자용 GPU/CPU에서 특히 최적화하여 높은 처리량과 정확도를 유지합니다.
- 유연한 제공자 지원: 로컬
llama-server, OpenAI 호환 API, OpenRouter, Gemini, 기존 Claude Code 및 OpenAI Codex 구독을 모두 지원합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트