useagenthq/useagent

useAgentは、オープンソースで自己ホスト可能なAI同僚プラットフォームであり、LLMエージェント(Claude Code、Codex、OpenCode、Pi)が隔離されたLinuxサンドボックス内でWeb閲覧、コマンド実行、コード編集、チームツール(Slack、GitHub、Gmail、Notionなど)との連携を可能にします。UIにはライブタイムライン、ターミナル、ワークスペースを備え、すべての実行をPostgreSQLに保存してリプレイ可能にし、再利用可能な「スキル」と共有知識ベースをサポートします。プロジェクトはBunランタイムで記述され、埋め込みにはpgvectorを使用し、AGPL-3.0ライセンスでリリースされ、商用ライセンスもオプションで提供されています。

kyutai-labs/hibiki

Hibikiは、ユーザーが話す途中で自然なターゲット音声とテキストをリアルタイムに生成するストリーミング音声-to音声翻訳モデルです。

woheller69/whisperIMEplus

Whisper エンジンを使用して、プライベートでオフラインで音声認識と翻訳を提供する Android 入力メソッドエディタ (IME)。

deeeed/audiolab

iOS、Android、Web で動作する React Native および Expo 向けのオーディオ処理モノレポ。オンデバイス音声認識(STT)、音声合成(TTS)、オーディオ分析を提供します。

yaojingang/yao-open-skills

Yao Open Skills は、意思決定分析、セキュリティ監査、チュートリアル作成、読書レポート可視化などのタスクに向けた再利用可能なAI「スキル」(構造化されたプロンプト+コードワークフロー)のオープンソースカタログです。各スキルは独自のフォルダにあり、スクリプト、ドキュメント、マルチフォーマットエクスポート(Markdown、HTML、PDFなど)を備えています。リポジトリはレジストリ、公開ルール、ヘルパー スクリプトを提供し、コレクションをクリーンでバージョン管理され、公開検索可能な状態に保ちます。

brummer10/guitarix

GuitarixはLinux専用のモジュール式仮想ギターアンプで、クラシックなDSPエフェクトとAIベースのアンプモデル(Neural Amp ModelerおよびRTNeural)を組み合わせています。スタンドアロンアプリ、VST3、LV2プラグインとして動作可能で、MIDIで制御でき、Raspberry PiなどのデバイスでGUIなしで動作するヘッドレスモードもサポートしています。READMEにはビルド手順、依存関係、ドキュメントリンク、最適化されたデプロイ用Dockerコンテナに関する情報が記載されています。

Wangnov/codex-threadripper

Rust製のCLI(Homebrew、npm、バイナリでもパッケージ化済み)で、CodexのSQLite状態DBとロールアウトJSONLログを書き換え、`model_provider` を変更してもチャットスレッドが可視になるようにします。1回限りの同期、継続的なウォッチモード、macOS、Linux、Windows向けのオプションのバックグラウンドサービスインストールをサポートしています。

getsentry/vitest-evals

vitest‑evals は、Vitest に AI 対応の評価機能を追加するモノレポです。さまざまなモデル SDK 用のハーネスアダプタ、再利用可能なジャッジ(例:事実性)、詳細な JSON 出力レポーター、ローカルの React UI、および PR マージをパス率やスコアに基づいてブロックできる GitHub Action を提供します。

linkerlin/PUAX

PUAXは、LLMエージェントにマインドセット層を追加する本番対応ランタイムです。アリーナ/ゲート/ドリームプリミティブ、シンプロンプト圧縮、ゼロ依存Python SDK、ハイブリッドトリガー検出、59の組み込み(およびカスタム)ロール、成果駆動型検証、人間を標的とした操作検出のためのカーボンシールド、再現可能なマルチモデルベンチマークスイートを提供します。システムはMCPサーバー(`npx puax-mcp-server`)を介してアクセスされ、人気のIDEにネイティブフックを注入し、ワンラインAMPミドルウェアを介してLangChain/AutoGenに直接埋め込むことができます。MITライセンスで本番対応とマークされています。

harry0703/AudioNotes

記録された音声および動画を構造化されたMarkdownノートに変換し、コンテンツに対してAI駆動のQ&Aを可能にするローカルファースト型のトランスクリプションツール。

descriptinc/descript-audio-codec

44.1 kHzの音声を8 kbpsで離散コードに圧縮する高精細ニューラル音声コーデックで、会話、音楽、環境音に対して約90倍の圧縮を実現します。

espressif/esp-sr

Espressifチップ向けの音声認識フレームワークで、オフラインでのウェイクワード検出、音声コマンド認識、および音声前処理を可能にします。

anthropics/anthropic-sdk-go

AnthropicのClaude APIに薄く、自然なラッパーを提供するGo SDKで、Go開発者がClaudeモデル(例:Claude Opus 4.6)をアプリケーションから直接呼び出せるようにします。`go get` でインストールし、APIキーでクライアントを作成し、`Messages.New` メソッドを使ってプロンプトを送信して応答を受信します。

wevm/incur

incur は、LLMエージェントが簡単に発見・利用できるコマンドラインツールを構築できるTypeScriptライブラリです。Zodによる型安全なコマンド定義、トークン効率的なTOON出力、組み込みのMCPおよびスキルファイル生成機能を備え、HTTP APIをCLIコマンドとしてラップまたは公開することも可能です。

NVIDIA/NeMo-text-processing

テキスト正規化および逆テキスト正規化を行うための Python パッケージ。音声処理システムのためのテキスト準備に使用されます。

tony1223/better-agent-terminal

Better Agent Terminal (BAT) は、Tauri 2 と React で構築されたクロスプラットフォームデスクトップアプリ(Windows/macOS/Linux)です。複数のプロジェクトワークスペースを管理でき、各ワークスペースにはスプリットパネルターミナル、ファイルブラウザ、Gitビューア、スニペットマネージャ、および埋め込みAIコーディングアシスタント(Claude Code または OpenAI Codex)が備わっています。AIはアプリ内に実行され、ストリーミング出力、権限モード、セッションの再開/フォーク、詳細な使用状況統計を提供します。オプションの `cx` CLI との統合により、軽量な意味的コードナビゲーションが可能。Homebrew、AppImage、または1行スクリプトでインストール可能。RustとNodeでソースからビルドすることもできます。LLMと安全かつ効率的にやり取りできる単一のウィンドウを求める開発者に最適です。

Optima-CityU/LLM4AD_Next

LLM4AD Nextは、自然言語による問題記述を、完全で実行可能な進化的アルゴリズム探索プロジェクトに変換するPythonツールキットです。対話型LLMコンサルタントがコードのスケルトン、設定、評価器を生成し、その後、組み込みの進化的手法(IslandGA、Diverse Island GA、EoHなど)が生成されたアルゴリズムを自動的に進化させます。また、進化に適したコードブロックを提案するアドバイザー、長期記憶サポート、Dockerイメージ、オンラインデモも提供します。

specula-org/Specula

Specula は、LLM コーディングエージェント(Claude Code、Codex など)を用いて、並行または分散コードの TLA⁺ 仕様を自動生成し、モデル検証を行い、発見されたバグをソースレベルのパッチとして再現するオープンソースツールです。自動、CI統合、インタラクティブモードをサポートし、Python 3.10+、Java 21+、および高性能な LLM を必要とし、Apache 2.0 ライセンスで公開されています。

shanggqm/codexU

codexUは、ローカルのOpenAI Codex(およびオプションのClaude Code)データを読み取り、クォータ割合、トークン使用トレンド、プロジェクト/スキルランキング、ローカル計算のAIリーダーシップスコア、推定APIコスト(「羊毛進捗」)を表示するネイティブmacOSメニューバー(およびWindows Tauri)アプリです。すべての処理はユーザーのマシン上で行われ、使用データはアップロードされません。

clawdotnet/openclaw.net

OpenClaw.NETは、.NETネイティブなAIエージェントランタイムおよびゲートウェイです。NativeAOT対応の実行可能ファイル、Webベースのチャット/管理UI、OpenAI互換API、80以上の組み込みツールアダプタ、マルチチャネル対応(Slack、Telegramなど)、クラウドおよびローカルLLMプロバイダ(OpenAI、Claude、Gemini、DeepSeek、Ollama、埋め込みGemma-4)との包括的統合を提供します。高リスクツール操作の監査・承認を可能にするオプションのガバナンス機能も備えています。Windows、macOS、Linuxで動作するセルフホステッドで観測可能なAIエージェントプラットフォームを構築したい開発者向けです。

marswaveai/TypeNo

macOS 向けのプライバシー最優先のローカル音声認識ツールで、アクティブなアプリケーションに直接音声を入力し、テキストを貼り付けることができます。

py-why/dowhy

DoWhyはエンドツーエンド因果推論のためのPythonライブラリです。因果グラフを定義し、自動的に因果効果を特定し、さまざまな統計手法で推定し、反証テストで堅牢性を検証できます。このライブラリは根本原因分析、反事実、介入サンプリングのためのグラフィカル因果モデルもサポートしています。`pip install dowhy`でインストールし、4ステップワークフロー(モデル → 識別 → 推定 → 反証)に従ってください。

InternScience/InternAgent

InternAgent‑1.5 は、長期にわたる科学的発見を目的としたオープンソースの自律エージェントフレームワークです。仮説の生成、実験(シミュレート含む)の設計・実行、アルゴリズムの最適化(MLEvolveコア経由)、およびDeep Researchパイプラインを用いた文献に基づく回答の提供が可能です。システムには永続的メモリモジュール、アルゴリズム発見および論文再現用のタスクスイート、発見モードまたはQAモードの統合起動スクリプトが含まれます。

Piebald-AI/claude-code-lsps

Claude Code(Anthropic の AI コーディングアシスタント)が、数十の言語に対し IDE に似た機能(定義へ移動、ホバー、参照検索など)を提供できるようにする LSP サーバー定義のマーケットプレイス。Claude Code ≥ 2.1.50 をインストールし、`npx tweakcc --apply` を実行してパッチを適用。`/plugin marketplace add Piebald‑AI/claude‑code‑lsps` でマーケットプレイスを追加。その後、`rust-analyzer`、`pyright`、`clangd` などの言語サーバーのバイナリを README に従ってインストール。リポジトリには `.lsp.json` 設定とマーケットプレイス JSON を同期させる検証スクリプトが含まれます。

xybrid-ai/xybrid

Xybridは、オープンソースでクロスプラットフォーム対応のSDKであり、大規模言語モデル(LLM)、音声認識(ASR)、音声合成(TTS)を、モバイル、デスクトップ、Unityデバイス上でローカルに実行できます。Flutter、Swift、Kotlin、Unity、Rust、Python向けのネイティブバインディングを提供し、多数のオープンソースモデルをサポート。マルチモデルパイプラインとして連結可能。クラウドサービスを一切必要としません。

lakesoul-io/LakeSoul

LakeSoulは、RustネイティブのメタデータとI/Oコアを持つオープンソースのレイクハウスフレームワークであり、ACIDトランザクション、インクリメンタルなupsert、自動コンパクション、きめ細かなRBACを提供し、Spark、Flink、Presto、Ray、Daft、Pythonベースのツールをサポートします。Vortexフォーマットを介して通常の行とマルチモーダル/ベクトルデータを保存でき、リアルタイムのCDCインジェクション、スナップショットクエリ、AI/MLパイプラインとのシームレスな統合を実現します。

bytechefhq/bytechef

ByteChefは、AIエージェントのオーケストレーションと視覚的ワークフロー自動化を統合したオープンソースプラットフォームです。組み込みのエージェントループ、250以上の事前構築済みコネクタ、複数プロバイダー対応LLM、メモリ/RAGバックエンド、ガードレール、Docker対応の自己ホストランタイムを備えています。無料のコア(Apache 2.0)はエディタ、エージェント、コネクタ、ポリグロットコードをカバー。エンタープライズ機能ではAPI公開ワークフロー、Gitネイティブプロモーション、SSO、AIゲートウェイ制御が追加されます。Docker Composeによるクイックスタートで数分でローカルインスタンスを稼働させられます。

missuo/koe

ASRとLLMによる修正を使用して、整理された音声テキストをあらゆるアプリに直接貼り付けることができる、軽量なmacOS用音声入力ツール。

nimroddolev/chime_tts

通知音とTTS音声をローカルで一つのシームレスなファイルに結合することで、オーディオの遅延を解消するHome Assistant統合機能。

tronghieuit/v-tts

マルチスピーカー合成とゼロショット音声クローニング機能を備え、CPU上で効率的に動作する軽量なベトナム語テキスト読み上げシステム。

derek-larson14/obsidian-claude-sidebar

Claude Sidebarは、Claude Code(または他のAIエージェントCLI)を実行するターミナルをサイドバーに直接埋め込むObsidianプラグインです。エージェントの自動起動、複数タブ、コンテキストメニューショートカット、YOLOモードをサポートし、マシン上の任意のフォルダで動作します。Obsidianのコミュニティプラグイン(または手動)でインストールでき、xterm.jsと小さなPython PTYバックエンドを使用してmacOS、Linux、Windowsで動作します。

caiovicentino/polymarket-mcp-server

Polymarket MCP Serverは、Claude(または任意のLLM)がPolymarketの予測市場ポジションを自律的に発見、分析、取引、監視できるようにするPythonベースのMCPサーバーです。市場発見、分析、取引、ポートフォリオ管理、リアルタイム監視にわたる45種類のツールを提供し、構成可能な安全制限とフルノード認証によって保護されています。Webダッシュボードによる視覚的な制御が可能で、デモ(読み取り専用)およびライブ取引設定の両方に対応した詳細なドキュメント、実APIテスト、MITライセンスが含まれています。

kardolus/chatgpt-cli

ChatGPT CLI は、多くの LLM プロバイダーに対応したクロスプラットフォームのコマンドラインクライアントです。ストリーミングクエリ、スレッドベースのチャット履歴、プロンプトファイルのインジェクション、マルチメディア I/O、および予算とポリシーの制約下でシェル/ファイル/Web 検索ツールを実行できる実験的なエージェントモード (ReAct / Plan-Execute) を提供します。また、カスタムツール呼び出しのために Model Context Protocol (MCP) をサポートしています。Homebrew またはビルド済みバイナリからインストールし、`~/.chatgpt-cli/config.yaml` で API キーを設定して、`chatgpt "your question"` または `chatgpt --interactive` でチャットを開始します。

jamsch/expo-speech-recognition

iOS、Android、Web で一貫した API を提供する、React Native および Expo 向けのクロスプラットフォームライブラリです。

claraverse-space/ClaraVerse

ClaraVerseは、AIエージェントチーム、階層型メモリ、および寛容なライセンスに焦点を当てたプライベートAIワークスペースです。チャット、マルチエージェント協働、ターミナルエージェント、ワークフロー自動化、および150以上の統合機能を提供します。

samuel-vitorino/sopro

ラップトップCPUやブラウザで高品質なゼロショットボイスクラウンティングとストリーミング音声合成を可能にする、120Mパラメータの軽量テキストto音声モデルファミリーです。

Natooz/MidiTok

MidiTok は、MIDI と abc 音楽ファイルをトークンシーケンスに変換する Python パッケージで、Transformer などの機械学習モデルに入力し、音楽生成、転写、その他の MIR タスクを可能にします。

OHF-Voice/speech-to-phrase

Home Assistant 用に設計された高速・ローカルの音声認識システムで、一般的な音声ではなく、特定の既知フレーズやデバイス名を認識します。

shivammehta25/Matcha-TTS

Matcha-TTS は高速で非自己回帰型のテキスト音声合成アーキテクチャで、条件付きフローマッチングを使用して高品質かつ効率的な音声合成を実現します。

hhblaze/DBreeze

DBreeze は、ACIDトランザクション、スキーマフリーのテーブル、フルテキスト検索をサポートする純粋C#で作られた、.NET向けの埋め込み型データベースであり、AIにとって重要な点として、HNSWベースの類似性検索を備えた統合ベクトルストアを提供し、LLMの埋め込みに対する高速な最近傍クエリを可能にします。

Makememo/MemoAI

ローカルファイルまたはYouTubeリンクからのオーディオおよびビデオの音声認識をAIで行い、翻訳および字幕作成機能を提供するツール。

sudoprivacy/sudocode

Sudo Codeは、LLM(Anthropic、OpenAI、xAI、Geminiなど)をターミナル内で直接実行するオープンソースでRustベースのCLIコードアシスタントです。モデル非依存、ファイル駆動型で、高度な開発者向けに完全な可視性と制御を提供します。単一の `scode` バイナリは対話形式またはパイプ対応のワンショットツールとして動作可能で、エディタ/Web UI向けACP APIを提供し、ローカル、リモートNexus VFS、またはマネージドエージェントの複数デプロイモードに対応します。インストールはシンプルなスクリプトで実行可能。MITライセンスで、プライバシー最適化、テレメトリなし、ベンダー依存なしを実現しています。

10000ge10000/luci-app-openclaw

OpenWrtルーターがOpenClaw AIゲートウェイをホストできるようにするLuCIプラグインで、Node.jsのインストール、LLMモデルの管理、WeChatなどのチャネルの有効化をWeb UIで行えます。

liyedanpdx/reddit-ai-trends

Reddit AI Trend Reportsは、DockerベースでMongoDBバックエンドのシステムであり、AI特化のサブレディットから投稿を取得し、画像キャプション、YouTubeトランスクリプトの要約、Webページのスクレイピングでオプションに補強した上で、GroqまたはOpenRouterのLLMを使用して毎日バイリンガル(英語/中国語)のトレンドレポートを生成します。

mrthinger/wow-voiceover

ElevenLabs TTSを使用して、World of WarcraftのNPC対話のAI音声を生成・再生するCLIとゲーム内アドオンからなるツールセット。

MahmoudAshraf97/ctc-forced-aligner

Hugging Face CTCモデルを使用して、1,100語以上の言語をサポートする効率的な音声とテキストの強制同期を実現するPythonパッケージ。

Deodat-Lawson/LaunchStack

LaunchStackは、AIネイティブアプリのためのTypeScriptファースト、ポートベースのエンジンです。取り込み、OCR、OCR、RAG、LLMチャット、およびバックグラウンドジョブのインフラストラクチャを提供します。Next.jsのリファレンスアプリは、エンジンをPostgreSQL + pgvector、S3、Inngest、およびGoogle Gemini(または任意のOpenAI互換エンドポイント)に接続する仕組みを示しています。パッケージは現在未公開ですがリリース準備が整っています。リポジトリはローカルまたはDocker経由で実行可能です。

lofcz/LLMTornado

LLM Tornado は、30以上のLLMプロバイダーとベクトルデータベースへの統合アクセスを提供する .NET SDK であり、エージェントオーケストレーションのプリミティブ、マルチモーダルI/O、エンタープライズ機能(ガードレール、OpenTelemetry)を追加します。クラウドAPIとローカルランタイム(Ollama、vLLM)と連携でき、強型のツール呼び出しをサポートし、Microsoft.Extensions.AI と統合可能です。NuGet経由でMITライセンスで配布されており、複数の公開プロジェクトで活用されており、積極的にメンテナンスされています。