Frugal Tokens: 分析编程智能体的 LLM 成本与 Token 使用情况
Frugal Tokens 提供对 LLM Token 支出的细粒度可视化
Frugal Tokens 是一款专门的分析工具,允许开发者探索编程智能体的成本和 Token 使用模式。通过提供处理的 Token、缓存复用和特定会话成本的详细明细,该工具使用户能够识别其 LLM 工作流中的低效之处,并衡量 Token 支出的投资回报率 (ROI)。
用于成本优化的详细会话指标
Frugal Tokens 会跟踪每个会话的几个关键绩效指标 (KPI),以帮助用户了解预算是如何支出的。根据演示数据,该工具监控以下指标:
- Processed Tokens: 处理的 Token 总量,在一次会话中,其范围可以从几千个(例如,“Quiet Narwhal Pass” 中的 12.4K)到几百万个(例如,“Granite Egret Vale” 中的 7.8M)。
- Cache Reuse: 从缓存中复用的 Token 百分比,这会显著影响成本。演示会话显示复用率高达 97.5%(例如,“Dawn Marten Landing")。
- Uncached Tokens: 必须从头开始处理的 Token 量,这会直接导致更高的成本。
- Reasoning Tokens: 对用于模型内部推理与最终输出的 Token 进行的具体细分。
- Cache Misses: 该工具可以识别“完全未命中”和“部分未命中”,从而精确指出对话中的哪一轮导致了缓存失败。
对开发者工作流的影响
分析这些指标允许开发者发现其构建流水线和交互模式中的隐藏瓶颈。用户报告称,该工具有助于识别在非活跃期间(例如,当开发者离开会话一小时或更长时间时)缓存未命中发生的频率。
社区见解与替代方案
Hacker News 上的用户强调了对于试图从不受控制的 Token 使用中恢复的公司而言,独立验证的数据点的重要性。
"这些这类经过独立验证的数据点对于那些试图在过去一年中因允许人们肆意使用 Token 而试图恢复过来的公司(以及个人!)来衡量 Token 支出的投资回报率将非常重要。"
虽然 Frugal Tokens 专注于成本和 Token 探索,但一些用户建议了互补工具,例如对于需要可视化工具调用和本地对话文件的用户,可以使用 agentsview.io。
对比会话数据
以下来自 Frugal Tokens 演示的数据点说明了不同编程智能体任务中成本和 Token 量的巨大差异:
| Session Name | Turns | Total Processed | Cache Reuse % | Total Cost |
|---|---|---|---|---|
| Granite Egret Vale | 18 | 7.8M | 96.9% | $6.21 |
| Dawn Marten Landing | 11 | 6.7M | 97.5% | $5.08 |
| Silver Tapir Garden | 21 | 6.1M | 94.3% | $5.43 |
| Starry Fawn Falls | 7 | 1.1M | 93.8% | $1.04 |
| Quiet Narwhal Pass | 1 | 12.4K | 20.6% | $0.07 |
Sources
相关
- 项目
- 项目
- 项目