Frugal Tokens: 分析編碼代理(Coding Agents)的 LLM 成本與 Token 使用量

Frugal Tokens 提供對 LLM Token 支出的細粒度可視化

Frugal Tokens 是一款專門的分析工具,允許開發者探索編碼代理的成本與 Token 使用模式。透過提供處理過的 Token、快取重用(cache reuse)以及特定對話階段(session)成本的詳細明細,該工具能讓使用者識別 LLM 工作流中的低效率之處,並衡量 Token 支出的投資報酬率(ROI)。

用於成本優化的詳細對話階段指標

Frugal Tokens 會針對每個對話階段追蹤幾項關鍵績效指標(KPIs),以幫助使用者了解預算花費在何處。根據演示數據,該工具監測以下指標:

  • Processed Tokens: 處理過的 Token 總量,範圍可從幾千個(例如「Quiet Narwhal Pass」中的 12.4K)到數百萬個(例如「Granite Egret Vale」中的 7.8M)。
  • Cache Reuse: 從快取中重用的 Token 百分比,這會顯著影響成本。演示對話顯示重用率高達 97.5%(例如「Dawn Marten Landing")。
  • Uncached Tokens: 必須從頭開始處理的 Token 量,這會直接導致較高的成本。
  • Reasoning Tokens: 針對用於模型內部推理與最終輸出的 Token 進行特定明細拆解。
  • Cache Misses: 該工具會識別「完全未命中(full misses)」與「部分未命中(partial misses)」,精確指出對話中的哪一次輪次(turn)導致了快取失效。

對開發者工作流的影響

分析這些指標可以讓開發者發現其構建流水線(build pipelines)與互動模式中隱藏的瓶頸。使用者回報指出,該工具能幫助識別在非活躍期間(例如開發者離開對話階段一小時或更長時間)發生快取未命中的頻率。

社群見解與替代方案

Hacker News 上的使用者強調了對於試圖從失控的 Token 使用量中恢復的公司而言,獨立驗證數據點的重要性。

"這些種類的獨立驗證數據點對於那些試圖衡量 Token 支出投資報酬率的公司(以及個人!)將會非常重要,因為他們正試圖從過去一年中任由使用者隨意使用 Token 的情況中恢復過來。"

雖然 Frugal Tokens 專注於成本與 Token 探索,但一些使用者建議了互補工具,例如對於需要視覺化工具調用(tool calls)與本地對話檔案的使用者,可以使用 agentsview.io。

對比對話階段數據

以下來自 Frugal Tokens 演示的數據點說明了不同編碼代理任務在成本與 Token 量上的巨大差異:

Session Name Turns Total Processed Cache Reuse % Total Cost
Granite Egret Vale 18 7.8M 96.9% $6.21
Dawn Marten Landing 11 6.7M 97.5% $5.08
Silver Tapir Garden 21 6.1M 94.3% $5.43
Starry Fawn Falls 7 1.1M 93.8% $1.04
Quiet Narwhal Pass 1 12.4K 20.6% $0.07

Sources

相關

  • 專案
  • 專案
  • 專案