JuliusBrussee/caveman
🪨 why use many token when few token do trick — Claude Code skill that cuts 65% of tokens by talking like caveman
What it solves
Caveman 是一个供 AI 代理人(如 Claude Code、Cursor、Gemini 与 Copilot)使用的插件/技能,能够减少响应中使用的输出 token 数量。它会剔除填充词与冗长的表述,同时保持完整的技术准确性,从而加快响应速度并降低 API 成本。
How it works
它以一组指示(即「技能」)的形式运行,告诉 AI 代理人去除填充词、使用片段式语句,仅保留答案的核心内容。支持多种压缩等级——lite、full、ultra 与 wenyan(古文中文)——且可通过 session flag 或规则文件自动激活。此外,还提供一个名为 caveman-compress 的工具,可将记忆文件(如 CLAUDE.md)重新写入压缩格式,以减少每次 session 的输入 token。
Who it’s for
开发者和 AI 编码代理人的用户,想要降低 token 消耗、提升 AI 响应速度,并在不失去技术精确度的前提下避免冗长的 AI 「闲聊」。
Highlights
- Significant Token Reduction: Benchmarks show an average of 65% reduction in output tokens.
- Multi-Agent Support: Compatible with 30+ agents including Claude Code, Codex, Gemini, Cursor, Windsurf, Cline, and Copilot.
- Language Agnostic: Compresses the style of the response regardless of the language (e.g., Portuguese, Spanish, French).
- Session Stats: Includes a
/caveman-statscommand to track real-time token usage and lifetime savings. - MCP Middleware: Provides
caveman-shrinkto compress tool descriptions for MCP servers. - Context Compression:
caveman-compressreduces the size of project memory files to save input tokens.