JuliusBrussee/caveman

🪨 why use many token when few token do trick — Claude Code skill that cuts 65% of tokens by talking like caveman

What it solves

Caveman 是一个供 AI 代理人(如 Claude Code、Cursor、Gemini 与 Copilot)使用的插件/技能,能够减少响应中使用的输出 token 数量。它会剔除填充词与冗长的表述,同时保持完整的技术准确性,从而加快响应速度并降低 API 成本。

How it works

它以一组指示(即「技能」)的形式运行,告诉 AI 代理人去除填充词、使用片段式语句,仅保留答案的核心内容。支持多种压缩等级——litefullultrawenyan(古文中文)——且可通过 session flag 或规则文件自动激活。此外,还提供一个名为 caveman-compress 的工具,可将记忆文件(如 CLAUDE.md)重新写入压缩格式,以减少每次 session 的输入 token。

Who it’s for

开发者和 AI 编码代理人的用户,想要降低 token 消耗、提升 AI 响应速度,并在不失去技术精确度的前提下避免冗长的 AI 「闲聊」。

Highlights

  • Significant Token Reduction: Benchmarks show an average of 65% reduction in output tokens.
  • Multi-Agent Support: Compatible with 30+ agents including Claude Code, Codex, Gemini, Cursor, Windsurf, Cline, and Copilot.
  • Language Agnostic: Compresses the style of the response regardless of the language (e.g., Portuguese, Spanish, French).
  • Session Stats: Includes a /caveman-stats command to track real-time token usage and lifetime savings.
  • MCP Middleware: Provides caveman-shrink to compress tool descriptions for MCP servers.
  • Context Compression: caveman-compress reduces the size of project memory files to save input tokens.