JuliusBrussee/caveman-code

Frozen — terminal coding agent measured at 1.93× fewer tokens than Codex CLI. Still works; active development moved to JuliusBrussee/caveman (caveman wrap).

解決的問題

Caveman Code 是一個基於終端的程式碼代理,旨在大幅減少 LLM 的令牌使用量與成本。它解決了 AI 代理產生的「廢話」(過多的填充文字)問題,以及通常被重新輸入模型上下文視窗的工具輸出(如長篇 git diff 或建置日誌)所帶來的巨大令牌開銷。

工作原理

本專案採用四層壓縮系統以最小化令牌消耗:

  1. 穴居人模式:強制模型以簡潔、技術性的片段回應,不包含填充或猶豫。
  2. 工具預算:對工具輸出(如 bash、grep、read)實施行數限制,並移除 ANSI 顏色與空行。
  3. 讀取去重:按會話對檔案進行指紋化,重複讀取同一檔案時返回占位符而非完整內容。
  4. RTK(Rust Token Killer):一個可選的外部 Rust 二進位檔,在輸出進入上下文前進一步壓縮 bash 輸出。

適用對象

希望在終端中使用成本效益高、高性能程式碼代理,並透過 API 金鑰或 OAuth 支援多種 LLM 提供商(包括 Claude、ChatGPT、Gemini 等)的開發者。

主要亮點

  • 自主目標循環:具備「Ralph 風格」的自動駕駛功能,可自主推進目標,支援狀態追蹤與預算限制。
  • 架構師/編輯器分離:使用慢速但高推理能力的模型進行規劃,使用快速且廉價的模型執行,以降低費用。
  • 計畫模式:只讀模式,代理可在不修改程式碼的情況下探索程式碼庫並產生計畫。
  • 廣泛的提供方支援:整合超過 20 個提供方和 6 種 OAuth 流程,實現便捷認證。
  • 會話管理:支援會話分叉、克隆和類似 git 的檢查點,可回滾程式碼與對話歷史。
  • MCP 兼容性:完全相容 Model Context Protocol (MCP) 伺服器與 Claude Code 的設定格式。

相關

  • 專案
  • 專案
  • 專案
  • 專案