livecontext-ai/livecontext-ce
LiveContext CEは、チャットプロンプトを完全なワークフロー、スコープ化されたLLMエージェント、データテーブル、および小さなWebアプリに変換する、オープンソースのセルフホスト型AIオートメーションプラットフォームです。視覚的なワークフローエンジン、エージェントごとの予算設定が可能なAIエージェント、700以上の組み込み統合機能、およびオプションのブラウザレンダリングアドオンを、単一のDocker-Composeスタックでデプロイ可能です。
edison7009/EchoBird
EchoBirdは、Tauri + Rustで構築されたクロスプラットフォームデスクトップアプリで、1つのUIから幅広いAIコーディングアシスタント、チャットエージェント、ローカルLLMランタイムのインストール、起動、管理が可能。その核となる機能である**Model Nexus**は、プロバイダーの認証情報を一度だけ保存し、各ツールのネイティブ設定を自動的に書き換えるため、ワンクリックでどこでもモデルを切り替えられる。
OpenMOSS/MOSS-TTS-Nano
0.1Bパラメータの多言語対応、極小サイズの音声生成モデル。リアルタイム推論と高精細ボイスクラーニングをCPU上で実現。
liustack/modsearch
ModSearchは、LLMチャットアプリ(特にDeepSeek Harness)に無料のリアルタイムウェブおよびX(Twitter)検索を追加するプラグインです。デフォルトではFirecrawlのキーレスティア(月1,000無料クレジット)を使用し、Antigravity CLI、Tavily、Exa、Grok、またはローカルフェッチャーにフォールバックでき、自動キーローテーションとクォータ処理を備えています。単一の`npx`コマンドでインストールし、モデルに検索やページ取得を依頼するだけです。スキルはソースと不確実性フラグを含む構造化JSONレスポンスを返します。
OpenLAIR/dr-claw
オープンソース、モデルに依存しないAI研究アシスタント。Web UI、CLI、デスクトップアプリを通じて、サーベイ → コード → 分析 → ドラフト → スライドの論文作成パイプラインを管理。Claude Code、Gemini、Codex、またはOpenRouterモデルを活用。100以上の組み込み「研究スキル」、ニュースフィード、Git統合、ワンクリック自動研究モードを備える。
hehehai/voxt
すべてのアプリケーションでライブトランスクリプション、AI翻訳、音声プロンプトによるテキスト再構成を提供するmacOS用音声入力・翻訳アプリ。
Blaizzy/mlx-audio
Apple Silicon向けの音声処理ライブラリで、テキストから音声への変換、音声からテキストへの変換、音声から音声への変換、音楽生成モデルに対する高速かつ効率的な推論を提供します。
langchain-ai/langchainjs
LangChain.jsは、大規模言語モデルを使用するアプリケーションを構築するためのTypeScriptフレームワークです。モジュール化されたコンポーネント(エージェント、モデル、リトリーバーなど)、多数の統合機能、および迅速なプロトタイピングと本番環境のモニタリングのためのツールを提供し、Node、ブラウザ、エッジランタイムなどをサポートしています。
erupts/erupt
Eruptは、JPAエンティティから完全なCRUD UIをアノテーション駆動で自動生成するJava管理フレームワークです。組み込みのAIモジュール(`erupt-ai` および `erupt-ai-claw`)により、複数のLLMプロバイダー連携、ロールベースのツールセキュリティ、チャット履歴、自然言語によるサーバー操作が可能。高速起動、豊富なUIコンポーネント、RBAC、マルチDB対応、オプションの商用拡張機能を備え、Spring Boot上でAI強化された管理パネルを即時構築できる完成形ソリューションです。
peteonrails/voxtype
Voxtype はオープンソースで MIT ライセンスの Linux アプリで、ローカルでリアルタイムの音声からテキストへの変換を提供します。高速な CPU モデル(Cohere Transcribe 9〜11 倍リアルタイム)を実行し、GPU/Intel NPU 加速をサポート。9 種類の交換可能な音声認識エンジン、多言語対応、ミーティングモードの音声認識、Wayland/X11 との深いつながり(ホットキー割り当て、メディアプレイヤーの自動一時停止、波形 OSD)を備えています。ユーザーがリモートサーバーを明示的に有効にしない限り、すべての処理はマシン上で行われます。
denizsafak/abogen
Kokoro-82Mモデルを使用して、ePub、PDF、テキストファイルを高品質なオーディオと同期字幕に変換するテキスト読み上げツール。
AbdoKnbGit/tau
Tauは、28のLLMプロバイダー(Claude、OpenCode、Mistralなど)を1つのインターフェースで統合するCLIベースのコーディングアシスタントです。ネイティブAPIアダプター、ファイル編集、LSP診断、スナップショットベースの元に戻す機能、ブラウザ自動化、WhatsAppやCloudflareトンネルによるリモート制御、サブエージェント、GitHub統合、自己学習ルールシステムを備えています。1つの`npx`コマンドでインストールし、ログイン、モデルを選択、自然言語タスクを発行するだけで利用可能。MITライセンスですが、最新のNode、Git、Bash、GitHub CLI、およびオプションでGoが必要です。
NeptuneHub/AudioMuse-AI
AudioMuse‑AIは、音楽コレクションの実際の音声を分析して音響フィンガープリントを作成するオープンソースでセルフホスト可能なアプリケーションです。このフィンガープリントを使って、類似トラックをクラスタリングし、即時で気分に応じたプレイリストを生成し、ライブラリを2次元の視覚的キャンバスにマッピングし、自然言語クエリに応答できます。Navidrome、Jellyfin、LMS、Lyrion、Emby、Plexと連携でき、Docker-Compose、Helmチャート、またはmacOS/Windows/Linuxのネイティブパッケージで実行可能です。
mkiol/dsnote
Linux および Sailfish OS 用の、オフラインの音声文字起こし、テキスト読み上げ、および機械翻訳を提供するプライバシー重視のノート作成アプリ。
HaujetZhao/CapsWriter-Offline
Windows 向けの完全オフラインで低レイテンシの音声からテキストへの変換ツール。ローカル ASR モデルを使用し、プッシュ・トゥ・トーク入力とファイルの字幕生成を実現。
TheDeathDragon/LiveTranslate
Windows 向けのリアルタイム音声翻訳ツール。システム音声とマイク入力をキャプチャし、LLM ベースのオーバーレイでライブ翻訳字幕を提供します。
langchain-ai/open-swe
Open SWEは、コード変更の計画、記述、テスト、レビュー、および提供を行う自律型AIエージェントを実行するための、LangChainベースのフレームワークです。GitHub、Slack、Linear、およびウェブ・ダッシュボードと統合し、隔離されたサンドボックス(LangSmith, Modal, など)を使用し、完全にカスタマイズ可能でセルフホスト可能です。
davebcn87/pi-autoresearch
pi-autoresearchは、AIコーディングアシスタントが測定可能なあらゆるターゲットに対して自律的な最適化ループ(編集・コミット・ベンチマーク・保持/元に戻す)を実行できるようにするpi-agent拡張機能です。状態は.auto/フォルダに永続化され、ライブウィジェット/ダッシュボード、信頼度スコアリング、オプションのチェックとフック、そしてレビュー可能なgitブランチを作成するファイナライズステップを提供します。
QwenAudio/SenseVoice
高精度かつ低遅延の音声基盤モデルで、多言語音声認識、感情検出、音声イベント識別を提供します。
KittenML/KittenTTS
25MBという小さなモデルでCPU上の高品質な音声合成を提供する、軽量なONNXベースのテキスト読み上げライブラリ。
mezmo/aura
AURA は、自社インフラ内に AI ベースの SRE エージェントを実行できるオープンソースプラットフォームです。設定可能なマルチエージェントランタイムを提供し、ツールの呼び出し、観測性システムの照会、安全な操作の実行が可能。データとモデルの使用状況を完全に自社で管理できます。
Anionex/banana-slides
Banana Slidesは、アイデア、アウトライン、アップロードされたドキュメントを完全に編集可能なPowerPointデッキに変換するオープンソースのAI駆動アプリです。LLM(Gemini、OpenAI、Claudeなど)と画像生成モデルを活用し、自然言語による「バイブ」編集、カスタムテンプレート、複数フォーマットインポート、PPTX/PDFエクスポート、オプションのナレーション付き動画出力をサポート。Docker、ワンクリッククラウドテンプレート、またはデスクトップバイナリでデプロイ可能。高速で高品質なスライド作成を求めるすべての人を対象としています。
razzant/claudexor
Claudexorは、複数のAIコーディングサービス(Codex、Claude Code、Cursorなど)を1つの型指定されたインターフェースで統合するローカルファーストのNode.js制御プレーンです。読み取り専用クエリ、パッチ生成書き込みターン、複数モデル間のBest-of-Nレースとクロスモデルレビュー、ライブクォータ追跡付きのクレデンシャルプロファイル、保護ファイル用の決定論的ゲート、macOSデスクトップアプリを備えています。すべての状態はあなたのマシン上に保存され、テレメトリは一切送信されず、SSH経由でリモートでも実行可能です。プロジェクトは現在も積極的にメンテナンスされており(v3.10.2)、監査可能でコスト制御可能なAI支援開発が必要な開発者やエージェント向けです。
nazdridoy/kokoro-tts
Kokoroモデルを使用したCLIテキスト音声変換ツール。テキスト、PDF、EPUBを自然な音声に変換し、ボイスブレンドとストリーミングをサポート。
ilyhalight/voice-over-translation
さまざまなウェブサイトの動画に対してリアルタイムの音声翻訳とAI字幕を追加するブラウザ拡張機能で、ユーザーが母国語で外国語コンテンツを視聴できるようにします。
dyoshikawa/rulesync
Rulesync は Node.js CLI で、AIアシスタントの設定を一元化します。`.rulesync/` ルールファイルを1つ書くだけで、Claude、Copilot、Cursor など数十のAIコーディングツールのネイティブ構成ファイルを生成、インポート、エクスポート、または変換できます。npm、Homebrew、またはシングルバイナリスクリプトでインストール可能です。選択的生成、広範なツール対応、非推奨機能の処理、プログラムAPIなどの機能を備えています。MITライセンス。
espeak-ng/espeak-ng
フォルマント合成を使用して、100以上の言語をサポートし、非常に小さなメモリ使用量で動作するコンパクトなオープンソースのテキスト読み上げ合成器。
qufei1993/skills-hub
Skills HubはTauriベースのデスクトップアプリで、AIコーディング「スキル」(プロンプト/エージェントバンドル)を集中管理し、シンボリックリンクまたはコピーを通じて、多くのAIコーディングツール(Cursor、Claude Code、Codexなど)のグローバルまたはプロジェクトレベルのスキルフォルダに同期します。探索・インストール、タグ付け、一括操作、ゴミ箱、Gitベースの自動デバイス同期、スケジュール更新を提供し、すべてが多言語UIで設定可能です。
VocaHQ/vocalinux
WhisperやVOSKなどのエンジンを使用して、デバイス内で音声をテキストに変換するプライバシー重視のLinux用音声認識入力アプリ。
openai/openai-python
OpenAI の API 用の公式 Python SDK。同期/非同期クライアント、チャット、コンプリーション、ビジョン、リアルタイム音声、ストリーミング、ページネーション、ファイルアップロード、Webhook 検証、および現代的なワークロードアイデンティティ認証(K8s、Azure、GCP、X.509)を完全に型チェック済みで提供。
SamurAIGPT/llm-wiki-agent
LLM Wiki Agent は、サーバーやデータベースを必要とせず、PDF、DOCX、マークダウンなどをローカルでインジェストし、エンティティとコンセプトを抽出して、成長し続ける相互リンクされたマークダウンウィキを構築し、矛盾を検出し、視覚的な知識グラフを生成するエージェント駆動のシステムです。
awslabs/mcp
オープンソースの MCP(Model Context Protocol)サーバーで、LLM で駆動されるツールが最新の AWS ドキュメント、IaC ガイドライン、安全な AWS API 呼び出しを取得可能。マネージドリモートサーバーとローカルバイナリ(ドキュメント、IaC、EKS など)を提供し、すべて stdio ベースのプロトコルでアクセス可能。
AVIDS2/memorix
Memorixは、任意のAIコーディングアシスタントにローカルファーストで検索可能なメモリストアを追加するNode.jsライブラリです。事実、設計の根拠、Gitから導かれるインサイトをSQLiteデータベースに永続化し、MCP、CLI、およびオプションのWeb UIを通じて公開します。単一の `memorix setup --agent <name>` コマンドをインストールするだけで、数十のエージェント(Claude Code、Codex、Copilot CLI、Cursor、Gemini CLIなど)が同じプロジェクトスコープのメモリを共有でき、スムーズな引き渡し、より良いコンテキスト保持、マルチエージェントオーケストレーションが可能になります。
rampstackco/claude-skills
ブランド、デザイン、コンテンツ、SEO、プロダクトマネジメント、グロース、オペレーションをカバーする、103 の Claude Skills からなる真のオープンソースライブラリ。Skills は再利用可能なプロンプト+メタデータのバンドルで、Claude がオンデマンドで読み込むことができ、ウェブサイトの構築、立ち上げ、最適化のためのエンドツーエンドの AI 駆動ワークフローを可能にします。
remsky/Kokoro-FastAPI
Kokoro-82M TTS モデル用の Docker 化された FastAPI ラッパーで、高品質で多言語対応の音声生成を可能にする OpenAI 互換 API を提供します。
TeamWiseFlow/xiaobei
xiaobei(小贝)は、中国のセルフメディア運営者向けのAI搭載パーソナルアシスタントです。オープンソースの**openclaw**フレームワーク上に構築され、ユーザーはWeChatチャットを通じて、記事、画像、ショート動画を複数のプラットフォーム(WeChat、小紅書、抖音、Twitterなど)で作成、フォーマット、公開できます。また、トレンド分析、パフォーマンス監視、24時間365日のAIカスタマーサービス、市場調査検索、ビジネス文書生成も提供します。インストールはワンライナースクリプトでプリビルドのtarballをダウンロードし、QRコードをスキャンするとボットが準備完了です。システムはUbuntu/macOS/Windowsで動作し、Alibaba Bailei大規模モデルAPI(または代替)を使用し、信頼性の高い自動化のためのカスタムアンチディテクトブラウザスタック(camoufox)を含みます。オプションの有料「VIP Club」では、プレミアムサポートとサービスが追加されます。
homelab-00/TranscriptionSuite
プライバシーと高速性を確保するために、さまざまなAIモデルを使ってコンピュータ上で音声をテキストに変換する、無料でオープンソースのトランスクリプションアプリ。
NoFxAiOS/nofx
NOFXは、大規模言語モデルが仮想通貨の無期限先物取引を生成できるようにする、オープンソースのセルフホスト型取引ターミナルです。Goランタイムが厳格なリスク制限を適用し、モデルが生成したすべての推論を保存し、9つの取引所をサポートします。ユーザーはオンチェーンのAI手数料ウォレットに資金を入れ、「Autopilot」を開始してモデルに自動取引を行わせることができ、公開リーダーボードで複数のトレーダーを比較することも可能です。インストールは、ワンクリックスクリプト、Docker、Railway、または手動ビルドで利用可能です。
coddingtonbear/obsidian-local-rest-api
Obsidian プラグインで、ローカル HTTPS REST API と Model-Context-Protocol サーバーを実行し、スクリプト、ブラウザ拡張機能、AIエージェントがバケツに対して完全な CRUD、ターゲット付きマーカーダウンパッチ、検索、コマンド実行などを実行できるようにします。認証はベアラートークンと自己署名証明書で行われ、Claude および Cursor 用の準備済み MCP 設定も提供されています。
matthartman/ghost-pepper
macOS向けのプライバシー重視型・デバイス内音声文字起こしおよび会議録音アプリ。ローカルAIモデルを使用するため、データがマシンから外部へ送信されることはありません。
crosswk/SayIt
Windows 向けのオープンソース音声入力ツールで、音声を認識し、AI でクリーニングして、任意のアプリケーションに洗練されたテキストを直接挿入します。
aiworkskills/wechat-article-skills
ユーザーの確認を各ステップで待つことで、記事の作成、レビュー、フォーマット、図解、WeChat公式アカウントへの発行までをエンドツーエンドで自動化するオープンソースのAIエージェントスキルセット。
tanweai/pua
pua は、企業風の「パフォーマンス改善計画」(PUA/PIP)の表現と7項目のデバッグチェックリストを、AIコーディングアシスタント(Claude Code、OpenAI Codex、Cursor、Kiro など)に注入するマルチプラットフォームスキルです。モデルが怠惰なパターン(再試行、ユーザーの責め、受動的待機)を示した場合や、`/pua` コマンドで手動起動すると自動的に作動します。このスキルはモデルが解決策を尽くし、結果を検証し、積極的に行動するよう強制し、中国語、英語、日本語の言語固有パックを提供します。少数のバグに対するベンチマークでは、修正数と検証ステップ数が増加しましたが、速度の向上は限定的です。インストールは各ツールのプラグイン/スキルシステム経由で行います(例:`npx skills add tanweai/pua --skill pua-en` で Claude Code に導入)
owainlewis/machinist
Machinist は、GoベースのCLIツールで、名前付きのAIコーディングコマンド(例:イシューからPRを生成)を定義し、任意のLLM互換実行可能ファイルでローカルで実行できます。リポジトリ、認証情報、モデル設定はワーカー上で保持され、完全なログストリーミング、タイムアウトの強制、人間によるレビューを前提としたプルリクエストの自動生成が行われます。繰り返し可能で監査可能なAI支援コーディングワークフローに最適です。
pipeshub-ai/pipeshub-ai
PipesHubは、Slack、Google Drive、GitHubなど企業データ(Slack、Google Drive、GitHubなど)にLLMを接続できるオープンソースで自己ホスティング可能なプラットフォームです。権限を考慮した知識グラフを構築し、出典付きの説明可能な回答を提供。LangChainを介して任意のLLMに対応。50以上の接続子、マルチモーダルドキュメント処理、ノーコードエージェントビルダー、Python、TypeScript、Go用SDKを備え、1つのDocker Composeインストーラーでデプロイ可能。
IAHispano/Applio
シンプルさとパフォーマンスに焦点を当てた高品質な音声変換ツール。音声変換のための柔軟なプラットフォームを提供します。
dark-hxx/CLI-Manager
CLI‑Managerは、Tauriベースのデスクトップアプリで、ローカルおよびSSHターミナルをClaude Code、Codex、その他のAIコーディングエージェントと統合します。リアルタイムのフック通知、ライブトークン/価格統計、差分表示付きの検索可能な複数ソースのセッション履歴、使用状況分析、プロバイダ切り替え、Git worktreeの隔離、バックグラウンドタスクの永続化、Telegram/Feishuを介したモバイルチャット統合を提供します。
kizuna-ai-lab/sokuji
Sokujiは、会議のためのリアルタイム双方向音声翻訳を提供するクロスプラットフォームのデスクトップアプリおよびブラウザ拡張機能です。WASM + WebGPUを使用したオンデバイスのASR、翻訳、TTSモデルを使用して完全にオフラインで動作させることも、OpenAI、Gemini、Sonioxなどのクラウドプロバイダーに接続することもできます。音声認識は99言語以上、翻訳は55言語以上、TTSは53言語をサポートし、Windows/macOS/LinuxおよびChrome/Edgeで動作し、プライバシー優先のローカル推論を提供します。