voice-pro: YouTube処理、音声クローニング、多言語翻訳のためのオールインワンAI吹き替えスタジオ
ASR、TTS、および音声クローニングを単一のワークフローに統合した、音声認識、翻訳、および多言語吹き替えのためのAI搭載ウェブアプリケーション。
opencodex: Codex, Claude Code, および Grok Build で任意の LLM を実行可能にするユニバーサル・プロバイダー・プロキシ
API レスポンスを変換することで、OpenAI Codex、Claude Code、Claude Desktop、および Grok Build で任意の LLM プロバイダーを使用可能にするローカル・プロキシ。
mesh-llm: マシン間でGPUとメモリリソースをプールして大規模モデルを実行する分散推論システム
OpenAI互換のAPIを介して、複数のマシンにわたってGPUとメモリをプールし、大規模モデルを実行するための分散LLM推論システム。
omnigent: デバイス間で複数のAIエージェントをオーケストレーションおよび管理するためのオープンソースのメタハーネス
AIエージェントのための共通のオーケストレーション層を提供するオープンソースのメタハーネス。ランタイムの切り替え、ポリシーの適用、およびデバイスを越えたリアルタイムの共同作業を可能にします。
EverOS: エージェントのための、Markdownを正準な信頼できる情報源として使用するローカルファーストなメモリランタイム
アプリやデバイスを横断してポータブルで持続的な長期メモリを提供するために、Markdownを信頼できる情報源として使用する、AIエージェント向けのローカルファーストなメモリランタイム。
semantic-router: 異種混合LLMインフラストラクチャ全体でMixture-of-Modelsシステムを構築するためのプログラマブルなルーティングレイヤー
品質、コスト、およびレイテンシを向上させるために、異種混合のコンピューティングおよびインフラストラクチャ全体でLLMリクエストのルーティングを最適化する、Mixture-of-Modelsシステム用のプログラマブルなルーティングレイヤー。
openmed: PII非識別化と医学的エンティティ抽出のためのローカルファーストな臨床テキストパイプライン
Python、Swift、Android、およびブラウザにわたってデバイス上で動作する、臨床エンティティ抽出とPII非識別化のためのローカルファーストなヘルスケアAIランタイム。
wigolo: wigolo: AIエージェントのためのローカルファーストなWebインテリジェンス
wigoloは、AIエージェント向けのローカルファーストなWebインテリジェンス・ツールキットであり、コア機能にAPIキーを必要とせず、検索、フェッチ、クロール、抽出、キャッシュ、類似検索、リサーチ、エージェントツールを提供します。MCPサーバー、RESTエンドポイント、またはSDKとして動作し、すべてのデータを `~/.wigolo/` 内にプライベートに保持し、高度なタスクのためにオプションのLLMベースの合成機能を提供します。 ## 主要機能 - 10個の統合Webツール (search, fetch, crawl, extract, cache, find_similar, research, agent, diff, watch) - MCPサーバー (コーディングエージェント用)、RESTエンドポイント、または埋め込み可能なSDK (TypeScript/Python) として動作 - ローカルファースト設計: データは `~/.wigolo/` に保持されます。LLM合成を明示的にオプトインしない限り、サードパーティへの呼び出しは行いません - コアツールはAPIキー不要; 公開検索エンジンとデバイス上のMLモデルを使用します - バイトオフセットによるソーススパンを含む逐次的な抜粋を返し、結果ごとに説明可能なスコアリングを提供します - セットアップ後のクエリあたりのコストはゼロ (結果をローカルにキャッシュして即座に再クエリが可能) - 主要なAIエージェントフレームワークと統合: LangChain, CrewAI, LlamaIndex, Vercel AI SDK - 人気のエージェントと直接連携: Claude Code, Cursor, Codex, Gemini CLI, OpenCode, VS Code, Windsurf, Zed, Antigravity ## 仕組み wigoloは、MCP (agent通信用のstdio経由のJSON-RPC)、REST API、およびSDKの3つのインターフェースを公開する単一のNode.jsプロセスとして動作します。検索ツールは、ランクフュージョンとデバイス上のMLによるリランキングを備えた18個の直接アダプターを使用します。フェッチツールは、観測可能なシグナル (SPAマーカー、アンチボット・チャレンジ) に基づいて、プレーンHTTPからheadless browserへとエスカレートする階層型ルーターを採用しています。結果は、キーワードとベクトルインデックスを組み合わせたローカルキャッシュに保存されます。オプションのLLM合成 (リサーチ/エージェントツール用) は、環境変数 (例: `WIGOLO_LLM_PROVIDER=gemini`) を介して設定可能です。すべての重いコンポーネント (ブラウザエンジン、埋め込みモデル) は、`~/.wigolo/` 内にローカルに保存され、遅延読み込みされます。 ## 制限事項 - 一部のチャレンジ保護されたサイトはIPレピュテーションに依存しています。データセンターIPでは、ホーム接続が成功する場所で失敗する可能があり、プロキシのオプトインについてセルフホスティングガイドを参照してください - LLM APIキーがない場合、`research` および `agent` ツールは合成された回答ではなく、生の証拠ブリーフを返します - 初期のセットアップには約1.5 GBの空きディスク容量が必要であり、ブラウザエンジンとデバイス上のモデルをダウンロードします - Node.js >= 20 が必要です ## エコシステム - CLI: ターミナル使用用の `npx wigolo <tool>` - インタラクティブシェル: NDJSONパイピング用の `wigolo shell` - REST API: `wigolo serve` がJSONエンドポイントを公開します - Docker: GitHub Container Registry および Docker Hub 上の公式イメージ - フレームワーク統合: LangChain, CrewAI, LlamaIndex, および Vercel AI SDK 用の公式パッケージ - エージェントスキル: `wigolo skills` で管理される11個のスキルカタログ ## ライセンス AGPL-3.0 ## ステータス パブリックベータ ## リンク - ドキュメント: [docs/README.md](docs/README.md) - 例: [examples/README.md](examples/README.md) - インストール: [docs/installation.md](docs/installation.md) - 設定: [docs/configuration.md](docs/configuration.md) - ツールリファレンス: [docs/tools.md](docs/tools.md) - SDKs: [docs/sdks.md](docs/sdks.md) - セルフホスティング: [docs/self-hosting.md](docs/self-hosting.md) - スキル: [docs/skills.md](docs/skills.md) - 貢献: [CONTRIBUTING.md](CONTRIBUTING.md)
markstream-vue: Markstream — Streaming Markdown renderers for AI chat
Vue 3 / Nuxt / VitePress パッケージで、Markdown をストリーム(例:LLM トークンストリーム)からインクリメンタルにレンダリングし、ちらつきを最小限に抑えて AI チャットインターフェースでの滑らかな体験を提供します。
note-gen: AIを使用して散らばった情報の断片を構造化されたノートに整理するローカルファーストのMarkdownアプリ
AIを使用して、音声録音やスクリーンショットなどの散らばった情報の断片を、構造化されたノートに整理するローカルファーストのMarkdownアプリ。
ms-swift: ms‑swift: LLMおよびマルチモーダルモデルのファインチューニングのためのスケーラブルで軽量なインフラストラクチャ
ms‑swiftは、数百のLLMおよびマルチモーダルモデルのファインチューニング、サービング、および評価を行うための、軽量でフルスタックなフレームワークです。LoRAスタイルの効率的な学習、高度な並列化、量子化、RLHF、およびGradioベースのUIを提供します。
banana-slides: 自然言語のプロンプトやドキュメントから編集可能なスライドとナレーション付き動画を作成するAIネイティブなプレゼンテーションジェネレーター
nano banana proモデルと自然言語編集を使用して、アイデア、ドキュメント、または画像から編集可能なプロフェッショナルなスライドを生成するAIネイティブなプレゼンテーションアプリ。
airllm: 1レイヤーずつロードすることで、コンシューマー向けGPUで巨大なLLMを実行するメモリ効率の高い推論エンジン
AirLLMは、モデルのレイヤーを一度に1つずつVRAMにロードすることで、低スペックなGPUで巨大なLLM(最大671Bパラメータ)を実行できるようにするライブラリです。
DeepSeek-Reasonix: DeepSeek‑Reasonix: ターミナル用の設定駆動型・プラグインベースのAIコーディングエージェント
DeepSeek-Reasonixは、設定およびプラグイン駆動のハーネスを使用し、DeepSeekモデルを利用するターミナルAIコーディングエージェントです。DeepSeekのprefix cacheに最適化された単一の静的Goバイナリとして提供され、トークンコストを低く抑えます。
WrenAI: AIエージェントが任意のデータベースから統制されたダッシュボードをデプロイできるオープンソースの生成型BIエンジン
AIエージェントが、任意のデータベースから統制されたSQLを生成し、チャートを作成し、共有可能なダッシュボードをデプロイするためのコンテキストレイヤーを提供する、オープンソースの生成型BIエンジン。
screenpipe: 画面と音声をキャプチャして、検索可能な履歴とAIエージェントを強化するローカルファーストのAIメモリシステム
画面と音声をキャプチャして、検索可能な履歴を作成し、AIエージェントにコンテキストを提供するための、ローカルファーストのAIメモリツール。
openai-agents-python: 音声およびサンドボックス実行をサポートする、マルチエージェント・ワークフロー構築のためのプロバイダー非依存フレームワーク
さまざまなLLMにわたってテキスト、音声、およびサンドボックス実行をサポートする、マルチエージェント・ワークフロー構築のための軽量でプロバイダー非依存のフレームワーク。
LightRAG: ベクトル検索とグラフ検索を橋渡しし、効率的な大規模インデックス作成を実現する軽量グラフベースRAGフレームワーク
知識グラフとベクトル埋め込みを組み合わせることで、深い文脈理解と効率的な増分更新を実現する、軽量なグラフベースのRAGフレームワーク。
vox-director: 単一のトピックからエディトリアルなペーパーコラージュ解説動画を作成するための自動化パイプライン
Voxスタイルのペーパーコラージュ解説動画の制作を自動化するエージェントスキル。スクリプト作成からキーフレーム、モーション、オーディオまで、すべてを処理します。
caveman: Caveman – AI コーディングエージェント用トークン節約プラグイン
Caveman は、AI コーディングエージェントが簡潔な原始人風の言語で話すようにし、技術的な内容はすべて維持しながら、散文における出力トークンを最大65%削減するプラグインです。
browser-use: LLMがウェブブラウザを制御して自動化されたウェブタスクを実行できるようにするAIエージェントフレームワーク
自然言語のコマンドを通じて、フォームの入力、データの抽出、QAテストなどのタスクを実行するために、AIエージェントがウェブブラウザを制御できるようにするライブラリおよびフレームワーク。
sglang: RadixAttentionと幅広いハードウェアサポートを備えた、LLMおよびマルチモーダルモデル向けの高性能サービングフレームワーク
SGLangは、高度なキャッシュとスケジューリングを通じて、多様なハードウェア上でLLMおよびマルチモーダルモデルの推論スループットとレイテンシを最適化する、高性能なサービングフレームワークです。
CodeWhale: BYOKと詳細な管理をサポートするモデルに依存しないターミナルコーディングエージェント
任意のLLMプロバイダーを使用して、コードの読み取り、ファイルの編集、およびコマンドの実行ができる、オープンソースのモデルに依存しないターミナル用コーディングエージェント。
mempalace: verbatim 形式での保存とプラグ可能なベクトルバックエンドを備えたローカルファーストAIメモリシステム
会話履歴を要約ではなく逐語的なテキストとして保存し、要約なしで高精度な検索を実現するセマンティック検索を利用したローカルファーストAIメモリシステム。
mnemosyne: Mnemosyne: ローカルファーストAIメモリレイヤー
Mnemosyneは、外部サービスやクラウドへの依存を必要とせず、ワーキングメモリ、エピソードメモリ、および時間的知識グラフ(TripleStore)を提供する、ローカルファーストでSQLiteベースのAIエージェント用メモリレイヤーです。
ECC: ECC: AIコーディングアシスタントのためのエージェントハーネス・オペレーティングシステム
ECCは、AIコーディングエージェントに、コードの計画、テスト、実装、レビュー、検証、記憶、および改善を行うための、調整されたエンジニアリングシステム(エージェント、スキル、コマンド、フック、メモリ、およびセキュリティスキャン)を備えさせるエージェントハーネス・オペレーティングシステムを提供します。
inkos: 多次元的な継続性監査とオープンワールド・インタラクティブ・フィクション機能を備えたプロフェッショナルなストーリー作成エージェントシステム
マルチエージェントによる監査パイプラインと構造化された長期記憶を通じて、物語の一貫性を保証する、長編ストーリー作成およびインタラクティブ・フィクション用の AI エージェントシステム。
apfel: apfel: macOS用のCLIおよびOpenAI互換サーバーとしてのAppleオンデバイスLLM
apfelは、Apple Silicon Mac上でプライベートかつ無料でAIを利用するために、AppleのオンデバイスLLMをターミナルおよびローカルのOpenAI互換サーバーとして提供します。
OpenOutreach: OpenOutreach: B2Bリードジェネレーションのためのセルフホスト型AIセールスエージェント
ライセンス取得済みのデータから企業プロファイルを見つけ出し、AIを使用して最適なリードを評価し、ユーザー自身のメールボックスからパーソナライズされたメールを送信することで、B2Bリードジェネレーションを自動化する、セルフホスト型、オープンソースのAIセールスエージェント。
herdr: 複数のAIエージェントを管理・調整するためのターミナルベースのエージェントマルチプレクサ
永続的なセッションとソケットAPIを通じて、ユーザーが複数のAIエージェントを監視、管理、および調整することを可能にするターミナルベースのエージェントマルチプレクサ。
open-connector: OpenConnector – LLMエージェントに数千のSaaSツールへの安全で再利用可能なアクセスを提供する、統合されたセルフホスト可能なコネクタカタログ
OpenConnectorは、構築済みActionのカタログを介してAIエージェントが1,000以上のSaaSサービスを呼び出せるようにするオープンソースのゲートウェイです。APIキーやOAuthトークンを安全に保存し、検査可能なリクエスト/レスポンスのスキーマを提供し、ローカル、Cloudflare Workers、Fly.io、またはOOMOLのホスト型SaaSとして実行可能です。TypeScript SDK、CLI、MCP、または直接的なOpenAPI呼び出しを通じて統合が可能で、Webコンソールにより管理者用およびデバッグ用のUIを提供します。
apify-mcp-server: AIエージェントを数千の既製ウェブスクレイパーおよび自動化ツールに接続するMCPサーバー
AIエージェントがウェブスクレイピング、データ抽出、および自動化のために数千のApify Actorsを使用できるようにするMCPサーバー。動的なツール発見機能とエージェントによる決済機能を備えています。
open-code-review: 決定論的なエンジニアリングとエージェント型ワークフローを組み合わせ、高精度な欠陥検出を実現するAI搭載コードレビューCLIツール
決定論的なエンジニアリングとエージェント型ワークフローを組み合わせ、高精度な行レベルのコード欠陥検出を提供するAI搭載コードレビューCLIツール。
SmartSub: SmartSub – デスクトップでワンクリックの動画字幕、翻訳、およびAI音声吹き替え
SmartSub (妙幕) は、動画のダウンロード、ローカルまたはクラウドのASRモデルによる音声の文字起こし、数十種類のサービスによる字幕の翻訳、校正、音声吹き替え(ゼロショット音声クローン化を含む)、および最後に字幕を動画に焼き付けたりマージしたりできる、オープンソースのクロスプラットフォーム・デスクトップアプリです。すべてオフライン優先で、オプションのGPU加速が可能です。
openlake: KVキャッシュのオフロードとモデルトレーニングを最適化するGPUワークロード向け分散ストレージエンジン
GPUワークロード向けにRustで構築された高性能分散ストレージエンジン。高速なKVキャッシュのオフロードとS3互換のオブジェクトストレージを提供することで、LLMの推論とトレーニングを最適化します。
Vibe-Skills: VibeSkills: ローカルSkillをルーティングし、L/XLレベルで作業を計画し、進捗を記録し、17のチェックを通じて結果を検証する、AIエージェント向けのSkillオーケストレーション・ハーネス。
VibeSkillsは、ローカルにインストールされたSkillを計画、実行、および検証するためにSkillをオーケストレートし、レベルベースのタスク分解、Skillの選択、実行の追跡、および17項目の検証チェックを提供します。
llama.cpp: 多様なハードウェア上でLLMおよびVLMをローカルで実行するための高性能C/C++推論エンジン
最小限の設定で幅広いハードウェア上で高性能なローカル実行を可能にする、LLMおよびVLM推論のための純粋なC/C++実装。
DiffSynth-Studio: 生成画像、動画、および音声モデルの最先端の探索とトレーニングのためのオープンソース拡散モデルエンジン
画像、動画、および音声のための最先端の生成モデルを統合、トレーニング、およびデプロイするための統一されたフレームワークを提供するオープンソースの拡散モデルエンジン。
OpenBiliClaw: 情報の繭を打破するためにローカルな心理プロファイルを作成するクロスプラットフォーム型パーソナライズド・コンテンツ発見エージェント
Bilibili、YouTube、Xなどの複数のプラットフォームにわたって、ユーザーの深い心理プロファイルを作成してパーソナライズドなコンテンツを能動的に発見する、ローカル実行型でプライバシー重視のAIエージェント。
PyRIT: 生成AIシステムにおけるリスクをプロアクティブに特定するためのオープンソースフレームワーク
PyRITは、セキュリティの専門家やエンジニアが生成AIシステムにおけるリスクをプロアクティブに特定することを可能にするオープンソースフレームワークです。
natively-cluely-ai-assistant: 検知不可能なステルスモードとローカルRAGメモリを備えた、プライベートで低遅延な面接コパイロット
面接や会議中に、低遅延、プライベート、かつ検知不可能なライブ支援を提供する、リアルタイムAI面接コパイロットおよびミーティングアシスタント。
sie: 単一のクラスターから100以上のオープンモデルを提供するエージェント向けセルフホスト型推論エンジン
単一のAPIを通じて複数のオープンソースモデルを提供するセルフホスト型推論エンジンで、異なるエージェントタスク用の別々のモデルサーバーの必要性を置き換えます。
ao: 量子化、スパース性、およびメモリ効率の高いトレーニングのための PyTorch ネイティブ最適化ライブラリ
推論を加速し、VRAM 使用量を削減するために、量子化、スパース性、およびメモリ効率の高いトレーニングツールを提供する、モデル最適化のための PyTorch ネイティブライブラリ。
pyod: マルチモーダルデータ向けエージェントワークフローを備えた包括的な異常検知ツールキット
複数のデータモダリティにわたる異常検知のための包括的なPythonライブラリで、AI駆動の外れ値調査のためのエージェントワークフローを備えています。
skypilot: 複数のクラウドとクラスターにまたがる AI コンピュートを管理・スケールする統合コントロールプレーン
統一インターフェースを使用して、任意のクラウドプロバイダー、Kubernetes、または Slurm クラスター上で AI ワークロードを実行・管理・スケールするシステム。
machine-learning-for-trading: ML駆動の取引戦略を構築・展開するためのエンドツーエンド研究から本番へのパイプライン
データ取得とリサーチからライブ本番展開まで、ML駆動の取引戦略を開発するための包括的なフレームワークとコードベースです。
N.E.K.O: 永続的なメモリとデスクトップ自動化を備えた能動的なマルチモーダルAIコンパニオン
リアルタイムの音声/映像理解、永続的な5次元メモリ、デスクトップ自動化機能を備えた、能動的なデジタルライフを実現するオープンソースのAIコンパニオンプラットフォームです。
loop-engineering: AI コーディングエージェントをオーケストレーションする自動制御システム設計のためのフレームワーク
AI コーディングエージェントをオーケストレーションする自動制御システムを設計するためのフレームワークで、手動のプロンプトを構造化された繰り返し可能なループに置き換えます。
faceswap:画像や動画で顔を認識・入れ替えるためのディープラーニングツール
画像や動画で顔を認識し入れ替えるための、抽出・学習・変換パイプラインを用いたディープラーニングツール。
Maestro: 並列実行と自動プレイブックを備えたAIコーディングエージェント群の管理のためのクロスプラットフォームオーケストレーター
自動プレイブック、Gitワークツリーによる分離、キーボード優先インターフェースを備え、複数のAIコーディングエージェントを並列にオーケストレーションするクロスプラットフォームデスクトップアプリ。