onllm-dev/onWatch

Track AI API quotas across Synthetic, Z.ai, Anthropic (Claude Code), Codex, GitHub Copilot & Antigravity in real time. Lightweight background daemon (<50MB RAM), SQLite storage, Material Design 3 dashboard. Zero telemetry.

解决的问题

许多AI提供商仅显示当前的配额使用快照,导致开发者产生"预算焦虑"和意外限流。onWatch 提供了一个跨多个提供商的统一、历史性的AI API配额使用情况视图,使用户能够追踪消耗速率、预测未来使用量,并避免意外触达使用上限。

如何工作

onWatch 作为一个轻量级后台代理运行(内存占用低于50 MB),使用API密钥轮询配置的AI提供商(如Anthropic、GitHub Copilot、Cursor等)。它将历史使用数据本地存储在SQLite数据库中,并提供Material Design 3风格的Web仪表板。它还支持通过API集成从自定义API驱动的工作流中导入本地JSONL数据。

适用人群

  • 个人开发者和自由职业者:使用AI编码代理(如Claude Code、Cline或Roo Code)的人,需要避免任务中途被限流。
  • 小型开发团队:共享API密钥,需要共享可见性以进行预算规划的团队。
  • DevOps和平台工程师:希望将AI使用监控集成到现有监控系统中,通过Prometheus指标实现的工程师。
  • 注重隐私的开发者:需要本地、可审计的监控,且无任何遥测数据的开发者。

主要亮点

  • 多提供商支持:支持追踪Anthropic、Codex、GitHub Copilot、MiniMax、Cursor、Grok和DeepSeek等多种服务的配额。
  • 统一仪表板:本地Web界面,包含时间序列图表、消耗速率预测和配额重置倒计时的实时计时器。
  • 集成体验:包含VS Code扩展,用于状态栏显示;以及桌面托盘伴侣应用(支持macOS、Linux、Windows),可快速检查配额。
  • 本地优先架构:单个二进制文件部署,所有数据本地存储在SQLite中;无外部遥测。
  • 告警功能:当配额超过警告或严重阈值时,支持通过邮件(SMTP)和浏览器推送通知。
  • 自定义遥测:可通过API集成,从自定义API驱动的工作流中导入本地遥测数据。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目