onllm-dev/onWatch

Track AI API quotas across Synthetic, Z.ai, Anthropic (Claude Code), Codex, GitHub Copilot & Antigravity in real time. Lightweight background daemon (<50MB RAM), SQLite storage, Material Design 3 dashboard. Zero telemetry.

해결하는 문제

많은 AI 제공업체는 현재의 쿼터 사용량만 표시하여 개발자들에게 "예산 불안"과 예기치 않은 제한을 초래합니다. onWatch는 여러 제공업체에 걸쳐 AI API 쿼터 사용량을 통합적이고 역사적으로 시각화하여, 사용자가 소비 속도를 추적하고 미래 사용량을 예측하며 예기치 않게 한도에 도달하는 것을 방지할 수 있도록 합니다.

작동 방식

onWatch는 API 키를 사용해 구성된 AI 제공업체(예: Anthropic, GitHub Copilot, Cursor 등)를 휴대용 백그라운드 에이전트로 주기적으로 확인합니다(메모리 사용량 50MB 미만). 이 데이터는 로컬 SQLite 데이터베이스에 저장되며, Material Design 3 웹 대시보드를 제공합니다. 또한 사용자 정의 API 기반 워크플로우를 위한 로컬 JSONL 인제스트도 지원합니다.

대상 사용자

  • 개인 개발자 및 프리랜서 : Claude Code, Cline, Roo Code와 같은 AI 코딩 에이전트를 사용하며, 작업 중 제한에 걸리는 것을 피하고자 하는 사용자.
  • 소규모 개발 팀 : API 키를 공유하며 예산 계획을 위한 공유 가시성을 필요로 하는 팀.
  • DevOps 및 플랫폼 엔지니어 : Prometheus 메트릭을 통해 기존 모니터링 스택에 AI 사용량 모니터링을 통합하고자 하는 사용자.
  • 개인정보에 민감한 개발자 : 외부 텔레메트리 없이 로컬에서 감사 가능한 모니터링이 필요한 사용자.

주요 기능

  • 다중 제공업체 지원 : Anthropic, Codex, GitHub Copilot, MiniMax, Cursor, Grok, DeepSeek 등 다양한 서비스의 쿼터를 추적.
  • 통합 대시보드 : 시계열 차트, 소비 속도 예측, 쿼터 리셋까지의 실시간 카운트다운 타이머를 갖춘 로컬 웹 인터페이스.
  • 통합 경험 : 상태 표시줄 표시를 위한 VS Code 확장 프로그램과 macOS, Linux, Windows용 데스크톱 트레이 동반 앱 제공.
  • 로컬 우선 아키텍처 : 모든 데이터가 SQLite에 로컬 저장되는 단일 바이너리 배포; 외부 텔레메트리 없음.
  • 알림 기능 : 경고 또는 심각한 임계값을 초과할 경우 이메일(SMTP) 및 브라우저 푸시 알림 지원.
  • 사용자 정의 텔레메트리 : API 인테그레이션을 통해 사용자 정의 API 기반 워크플로우에서 생성된 로컬 텔레메트리 수신 가능.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트