TokenRhythm/opensquilla

OpenSquilla — Token-Efficient AI Agent with same budget, higher intelligence density

OpenSquilla – トークン効率の高いマイクロカーネル型AIエージェント

何であるか – OpenSquillaは、各ユーザーの入力を、要求を処理できる最も安価なLLMにルーティングするローカル実行型AIエージェントフレームワークです。軽量なデバイス内モデルルーター(SquillaRouter)、永続的メモリ、サンドボックス化されたツールレイヤー、組み込みのWeb検索およびデバイス内埋め込み、すべてを1つの「ターンループ」内に統合しています。同じループがデスクトップGUI、CLI、チャットチャンネル統合をすべてサポートしており、エージェントとやり取りする方法に関係なく、挙動は同一です。

なぜ重要か – 各ターンに対して自動的に最もコスト効率の良いモデルを選択することで、OpenSquillaはトークン消費を削減しながらも、機能性を維持します。ルーターは複数のモデルをアンサンブルすることもでき、開発者らはこれが「Fable 5」ベンチマークを上回ると主張しています。


主要なコンポーネント

コンポーネント 役割
SquillaRouter デバイス内ルーターで、どのLLMを呼び出すかを決定(ONNX Runtime、LightGBMなどに対応)
プロバイダーレイヤー 20以上のLLMプロバイダー(TokenRhythm、OpenRouter、OpenAI、Anthropic、Ollama、Gemini、Qwen/DashScopeなど)を統一APIで扱える
永続的メモリ セッション間で長期間のコンテキストを保存
レイヤードサンドボックス ツール実行と再試行を隔離し、安全なツール利用を保証
組み込みWeb検索および埋め込み 外部サービスなしでリトリーバー増強生成(RAG)を可能に
コントロールコンソール Electronシェルにパッケージ化されたVueベースのWebUIで、デスクトップ用

インストール方法(1つを選択)

  1. デスクトップインストーラー – 事前にビルドされた .dmg(mac Apple Silicon)または .exe(Windows)で、Vueコンソールとすべてのネイティブランタイムを含みます。GitやNodeは不要です。
  2. クイックターミナルインストール – すべてのOSで推奨。uv Pythonパッケージマネージャーを使ってGitHubリリースからwheelをインストールします:
    uv tool install --python 3.12 "opensquilla[recommended] @ https://github.com/TokenRhythm/opensquilla/releases/download/v0.5.4/opensquilla-0.5.4-py3-none-any.whl"
    opensquilla onboard
    opensquilla gateway run
    
  3. ソースからインストール – リポジトリをクローン(Git LFSでモデル資産を取得)、提供された scripts/install_source.sh/.ps1 を実行してVue UIをビルドし、依存関係をインストール、opensquilla コマンドを登録します。
  4. ソースから開発 – コントリビューター向け。uv sync を使ってローカル編集可能な環境を作成し、その後 uv run opensquilla … を実行します。

注意 – ルーターにはネイティブランタイム(WindowsではONNX Runtime、macOSではlibomp)が必要です。デスクトップインストーラーにはこれらがバンドルされていますが、ターミナルインストールではWindowsでVisual C++リダイストラブルを、macOSでは brew install libomp をインストールする必要がある場合があります。


一般的なワークフロー

# エージェントのセットアップ(一度だけ)
opensquilla onboard          # 設定ファイルを作成、install_idを生成、テレメトリのオプトアウトプロンプトを実行

# ゲートウェイの起動(ターンを処理する長時間実行プロセス)
opensquilla gateway run

# CLI、Web UI、または接続されたチャネル(Slack、Discord、Matrixなど)でやり取り
opensquilla chat "AIセーフティに関する最新ニュースを要約して"

ゲートウェイは以下の手順を実行します:

  1. ユーザーのターンを受け取る。
  2. SquillaRouterに、トークン予算内で回答可能なプロバイダーを確認する。
  3. 選択されたLLMを呼び出し、必要に応じて取得したWeb検索結果や埋め込みでプロンプトを拡張する。
  4. ターンを永続的メモリに保存し、ルーティング決定をログに記録する。
  5. 応答を元のインターフェースに返す。

サポートされる統合(標準搭載)

  • Feishu、Telegram、DingTalk、QQ、WeCom、Slack、Discord
  • オプション拡張:Matrix(E2E暗号化対応)、WeasyPrintによるPDF生成など

プライバシーとテレメトリ

OpenSquillaは初回起動時と1日1回、擬似匿名のテレメトリを送信します:インストールID(ハッシュ化されたMAC/IP)、バージョン、OS、トークン使用量の集計、インストール方法。コンテンツ、APIキー、個人識別情報は送信されません。テレメトリと自動更新チェックは以下のいずれかで無効化できます:

[privacy]
disable_network_observability = true

またはレガシーな環境変数 OPENSQUILLA_TELEMETRY_DISABLED / OPENSQUILLA_UPDATE_CHECK_DISABLED


ライセンスとコミュニティ

  • ライセンス:Apache 2.0(許容性が高く、商用利用を許可)。
  • ドキュメント:リポジトリ内に製品ガイド、CLIリファレンス、および技術報告書(arXiv 2607.11399)がバンドルされています。
  • リリース状態:0.5.4(安定版)。継続的な開発は main ブランチで追跡され、CIバッジで自動テストの状況が表示されます。
  • サポート:GitHubでイシューを開くことができます。ウェブサイト opensquilla.ai には報告書、ドキュメント、連絡先情報へのリンクがあります。

誰が恩恵を受けるか?

  • 開発者:個別のルーターを組み立てる必要なく、ローカルで実行され、コストを意識したLLMエージェントを必要とする人。
  • プロダクトチーム:Windows/macOS/Linuxで動作する単一のバイナリと、既製のデスクトップUIを必要とする人。
  • データプライバシーに厳しい要件を持つチーム:ルーティングとメモリのコア部分がデバイス内に留まるため。
  • 研究者:「エージェントルーティング」と、付随する技術報告書で説明されるデータ・フライホイール概念に興味がある人。

クイックスタートチェックリスト

  1. uv をインストール(またはソースからビルドする場合はPython 3.12+とNode 22.12+を用意)。
  2. インストール方法を選択(デスクトップインストーラーまたは uv tool install)。
  3. opensquilla onboard を実行して設定を生成。
  4. opensquilla gateway run でゲートウェイを起動。
  5. opensquilla chat でやり取りするか、http://localhost:… でWeb UIを開く。

結論:OpenSquillaは、トークン効率の高いルーティング、統一インターフェース、デバイス内プライバシーに焦点を当てた、実用的でプロダクションレベルのAIエージェントプラットフォームです。ドキュメントが充実しており、クロスプラットフォーム対応、許容性の高いオープンソースライセンス(Apache 2.0)でリリースされています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト