JuliusBrussee/caveman-code

Frozen — terminal coding agent measured at 1.93× fewer tokens than Codex CLI. Still works; active development moved to JuliusBrussee/caveman (caveman wrap).

해결하는 문제

Caveman Code는 LLM의 토큰 사용량과 비용을 극적으로 줄이기 위해 설계된 터미널 기반의 코딩 에이전트입니다. AI 에이전트가 생성하는 '무의미한 말들'(과도한 부가 텍스트)과 일반적으로 모델의 컨텍스트 창에 다시 입력되는 도구 출력(예: 긴 git diff 또는 빌드 로그)으로 인한 막대한 토큰 오버헤드를 해결합니다.

작동 방식

이 프로젝트는 토큰 소비를 최소화하기 위해 4단계 압축 시스템을 사용합니다.

  1. Caveman Mode: 모델이 부가적인 표현이나 회피적인 표현 없이 간결하고 기술적인 조각만을 출력하도록 강제합니다.
  2. 도구 예산: 도구 출력(예: bash, grep, read)에 줄 수를 제한하고 ANSI 색상 및 빈 줄을 제거합니다.
  3. Read Dedup: 세션별로 파일을 지문화하여 동일 파일의 반복 읽기 시 전체 내용 대신 스텁을 반환합니다.
  4. RTK (Rust Token Killer): 선택적 외부 Rust 바이너리로, bash 출력을 컨텍스트에 입력하기 전에 추가로 압축합니다.

대상 사용자

API 키 또는 OAuth를 통해 Claude, ChatGPT, Gemini 등 다양한 LLM 제공업체를 지원하는, 비용 효율적이고 고성능의 터미널 내 코딩 에이전트를 원하는 개발자.

주요 기능

  • 자율 목표 루프: 상태 추적과 예산 제한을 갖춘 'Ralph 스타일' 자동 조종 기능으로 목표를 자율적으로 달성할 수 있습니다.
  • 아키텍처/에디터 분리: 계획에는 느리지만 고정밀 모델, 실행에는 빠르고 저렴한 모델을 사용하여 비용을 절감합니다.
  • 계획 모드: 편집 없이 코드베이스를 탐색하고 계획을 생성하는 읽기 전용 모드입니다.
  • 광범위한 제공업체 지원: 20개 이상의 제공업체와 6가지 OAuth 흐름을 통합하여 인증을 간편하게 지원합니다.
  • 세션 관리: 세션 분기, 포크, git과 유사한 체크포인트를 지원하여 코드와 대화 기록을 되돌릴 수 있습니다.
  • MCP 호환성: Model Context Protocol (MCP) 서버 및 Claude Code의 구성 형식과 완전히 호환됩니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트