onllm-dev/onWatch

Track AI API quotas across Synthetic, Z.ai, Anthropic (Claude Code), Codex, GitHub Copilot & Antigravity in real time. Lightweight background daemon (<50MB RAM), SQLite storage, Material Design 3 dashboard. Zero telemetry.

解決的問題

許多AI提供者僅顯示目前的配額使用快照,導致開發者產生「預算焦慮」與意外限流。onWatch 提供跨多個提供者的統一、歷史性AI API配額使用情況視圖,讓使用者能追蹤消耗速率、預測未來使用量,並避免意外觸達使用上限。

如何運作

onWatch 作為一個輕量級背景代理運行(記憶體佔用低於50 MB),使用API金鑰輪詢設定的AI提供者(如Anthropic、GitHub Copilot、Cursor等)。它將歷史使用資料本地儲存在SQLite資料庫中,並提供Material Design 3風格的Web儀表板。它也支援透過API整合,從自訂API驅動的工作流程中匯入本地JSONL資料。

適用對象

  • 個人開發者與自由工作者:使用AI編碼代理(如Claude Code、Cline或Roo Code)的人,需要避免任務中途被限流。
  • 小型開發團隊:共享API金鑰,需要共享可見性以進行預算規劃的團隊。
  • DevOps與平台工程師:希望將AI使用監控整合至現有監控系統中,透過Prometheus指標實現的工程師。
  • 重視隱私的開發者:需要本地、可審計的監控,且無任何遠端遙測資料的開發者。

主要亮點

  • 多提供者支援:支援追蹤Anthropic、Codex、GitHub Copilot、MiniMax、Cursor、Grok和DeepSeek等多種服務的配額。
  • 統一儀表板:本地Web介面,包含時間序列圖表、消耗速率預測與配額重置倒數計時器。
  • 整合體驗:包含VS Code擴充功能,用於狀態列顯示;以及桌面托盤伴侶應用(支援macOS、Linux、Windows),可快速檢查配額。
  • 本地優先架構:單一二進位檔部署,所有資料本地儲存在SQLite中;無外部遙測。
  • 告警功能:當配額超過警告或嚴重閾值時,支援透過郵件(SMTP)與瀏覽器推送通知。
  • 自訂遙測:可透過API整合,從自訂API驅動的工作流程中匯入本地遙測資料。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案