tigerless-labs/cost-xray
See what Claude Code and Codex actually send to the API — and what each part costs.
解决的问题
大多数 AI 编码代理使用工具仅读取本地日志,忽略了在模型调用前组装的「不可见」请求时上下文——如系统提示、工具模式和 MCP 块。cost-xray 提供对实际 API 流量的可见性,清晰展示发送给模型的内容以及请求中每个具体部分的成本。
工作原理
它作为本地捕获中继,使用 mitmproxy 运行。拦截编码代理(如 Claude Code 或 Codex)与模型 API 之间的 HTTP/HTTPS 流量。
- 捕获:对 Claude Code 使用反向代理,对 Codex 使用带作用域的本地 CA 的正向代理。
- 隐私:所有数据均本地存储于
~/.cost-xray/,在写入磁盘前 API 密钥和敏感信息已被脱敏。 - 分析:通过独立的材料化器对捕获的原始字节进行分词和定价,确保不会对实时中继造成延迟。
- 去重:为节省空间,仅存储唯一的块(消息、模式),并使用每轮的增量(delta)表示重复的会话历史。
适用人群
希望优化 API 成本、识别上下文窗口中「无用负担」(如未使用的 MCP 服务器)并精确理解上下文窗口占用构成的 AI 编码代理使用者。
主要亮点
- 细粒度成本归因:追踪到单个工具调用和特定来源的成本,而非仅限于会话总成本。
- 上下文窗口可见性:清晰展示上下文窗口中实际占用空间的内容,包括系统提示和工具模式。
- 浪费检测:标记那些被配置为注入每个请求但从未实际使用的 MCP 服务器和工具。
- 分词准确性:使用经过校准的 Claude 私有分词器估算器,确保总账单金额精确无误。
- 自愈式捕获:封装器确保若代理宕机,代理可自动重启代理或直接运行,持续工作。
- TUI 仪表盘:提供实时终端用户界面,可从代理到项目、会话,再到具体 API 调用逐层深入分析。
相关
- 项目
- 项目
- 项目
- 项目
- 项目