theJayTea/WritingTools

Writing Tools は、Windows、Linux、macOS用の無料でオープンソースのデスクトップアプリです。ホットキーでコンピュータ上のどこからでもLLMを呼び出せます。校正、再執筆、トーン変更、翻訳、WebページやYouTubeの字幕の要約、モデルとのチャットが可能です。Gemini、OpenAI、AnthropicなどのクラウドAPI、またはOllama、llama.cpp、Apple-silicon MLXを介してローカルモデルを実行できます。プライバシー重視(テレメトリなし、APIキーはローカル保存)で、GPL-v3ライセンスのもとで提供されています。

umputun/cc-thingz

cc-thingzは、ブレインストーミング、PRレビュー、構造化計画、リリース自動化、およびさまざまな思考ツールなど、より高レベルの開発者ワークフローを追加するClaude Codeプラグインのマーケットプレイスです。Claudeの`/plugin`コマンドでインストールし、いくつかのJSONフックを設定して、新しいスラッシュコマンド(例:`/brainstorm:do`、`/review:pr`、`/planning:make`)を呼び出します。プラグインはClaudeのサブエージェント、フック、エディタオーバーレイを使用して、計画、コードレビュー、さらには自律的な計画実行を自動化し、Claude Codeをより強力なコーディングアシスタントにします。

ucsandman/DashClaw

DashClaw は、AIコーディングエージェント(Claude Code、Codex、Hermes、OpenClawなど)からの潜在的に危険なツール呼び出しをインターセプトできる自己ホスティング可能なガードです。行動をブロックまたはキューに入れ、リモート承認インボックスにルーティングし、署名付きの意思決定レジストリを記録します。Node/Python SDK、REST API、主要エージェントランタイム用プラグインを提供し、監査可能な証拠とともに安全な未監視エージェント実行を可能にします。

lllllllama/RigorPilot-Skills

RigorPilot Skills は、AIアシスタントやCLIが研究論文のREADMEに記載されたコマンドを自動的に実行し、正確な出力をキャプチャし、並べて表示された注釈付きREADMEに簡潔な証拠カードを挿入できるオープンソースツールキットです。元のファイルはバイト単位で保持され、ログ、コマンドトレース、オプションのモデルランナーのチェックポイントは構造化された `repro_outputs/` バンドルに保存されます。再現、分析、安全なデバッグ、探索など、再現可能なAI研究ワークフローに使える再利用可能な「スキル」のセットを提供します。

EthanAlgoX/AIStock

AI Stockは、中国、香港、米国の株式向けのオープンソースのLLM駆動型リサーチワークスペースです。単一のトレーダーが自然言語での会話を開始でき、決定的な金融ツールとオプションのエキスパートエージェント連携(パイプライン、ディベート、投票)を実行し、保存されたリサーチレポートとペーパートレードシミュレーションを生成します。FastAPI(Python)とReact 19フロントエンドで構築され、設定可能なLLMプロバイダー、厳格な機能ホワイトリスト、モジュール式のエージェントスキルツールアーキテクチャをサポートしています。MITライセンス。

Intelligent-Internet/zenith

Zenithは、Claude Code、Codex、またはHermesを長期間にわたって実行可能なコーディングエージェントとして動作させるPythonベースのハーネスです。オーケストレーターはプロジェクトの状態を繰り返し確認し、ワーカー/テスターのサブエージェントを起動、再利用可能なスキルを登録、再計画を行い、タスクが本当に完了するまで停止しません。Frontier SWEベンチマークで、GPT-5.5を用いたZenithは最良の平均順位を達成しながら、最も強力なベースライン(RALPH)のコストの半分以下で運用されています。リポジトリにはCLI、MCPサーバー、ACPアダプター、および完全な技術報告書が含まれます。

DBraun/DawDreamer

VSTプラグインサポートやFaust信号処理をPythonスクリプトに取り入れる、デジタルオーディオワークステーション(DAW)機能を備えたPythonフレームワーク。

modular/mojo-gpu-puzzles

実践的なパズルを通じて、`pixi` ベースの環境、テストハーネス、コミュニティサポートを備えた、GPUプログラミングを教えるインタラクティブでオープンソースのチュートリアル。

MontrealCorpusTools/Montreal-Forced-Aligner

Kaldi を使用して音声データセットの強制同期を実行するコマンドラインユーティリティです。

ByteDance-Seed/Triton-distributed

Triton-distributedは、ByteDance-Seedがオープンソース化したコンパイラであり、Triton言語を拡張してGPUの計算と通信をオーバーラップさせるためのプリミティブを提供します。NVIDIAおよびAMD GPU上で高性能な分散カーネル(GEMM、MoE、flash-decode、AllToAllなど)を実現し、手動でチューニングされたライブラリに匹敵する高速化を提供します。ソースまたはビルド済みのpip wheelからインストールし、@triton_dist.jitを使用してカーネルを記述し、提供されている低レベル通信APIを利用できます。プロジェクトは活発に更新されており(最新ニュースは2026年9月)、MITライセンスで公開されています。

VOICEVOX/voicevox

VOICEVOX音声合成システムのための、AIによる音声生成を容易にするユーザーフレンドリーなインターフェースを備えたグラフィカルエディタ。

amicalhq/amical

Amical は、Whisper を用いた音声認識と、Ollama を通じてローカルで実行されるLLM(大規模言語モデル)を活用したオープンソースでオフライン優先のデスクトップ音声入力アプリです。すべてのデータはユーザーのマシン上でプライベートに保持されます。

openai/openai-java

公式のJava SDKでOpenAIのAPIを同期/非同期、ストリーミング、Workload-identity認証、オプションのBedrockブリッジをサポート。Maven/Gradle対応。

adolfousier/opencrabs

OpenCrabs は Rust ネイティブのターミナル専用 AI エージェントで、複数の LLM プロバイダーに直接接続し、すべてのチャット、メモリ、キーをローカルに保存します。マルチモーダル入力、ツール統合、マルチエージェントオーケストレーション、実験的な自己改善ループを備えた豊富な TUI を提供します。

Deng-m1/MaliangAINovalWriter

Maliang AI Novel Writer (AINoval) は、中国のWeb小説作家がAIの支援を受けて長編小説を書けるオープンソースのウェブプラットフォームです。Flutter-Webによる豊富なテキストエディタ、階層的なコンテンツ管理、AI駆動のアウトライン/シーン生成、構造化された世界観ツリー、プロンプト/プリセット管理、ユーザー、モデル、コスト、コンテンツモデレーションを管理するフル機能の管理コンソールを統合しています。バックエンドは、LangChain4jを用いたLLMオーケストレーションのためのSpring Boot 3(Java 21)、MongoDBによるストレージ、Chromaによるベクトル埋め込みを採用。1つのDocker-Composeファイルでデプロイ可能。その後、提供されたスクリプトで管理者アカウントを作成します。個人作家、執筆チーム、プラットフォーム運営者にとって、AI強化された小説作成と堅牢な運用ツールを必要とする方に最適です。

Xiaobin-Rong/gtcrn

GTCRNは低リソース環境向けに設計された超軽量音声強調モデルであり、最小限のパラメータと計算負荷で高品質なノイズ除去を実現します。

mario-andreschak/FLUJO

FLUJOは、プライベートAIエージェントを構築するためのオープンソースでローカルホスト可能なプラットフォームです。複数のLLMプロバイダーとMCPサービスに接続でき、シンプルなレシピUIまたはドラッグアンドドロップのフローダイアグラムでエージェントを構成できます。暗号化されたシークレットストレージ、ビジュアルデバッグ、自動化トリガー、OpenAI互換エンドポイント、Docker/インストーラー/npxでのデプロイオプションを備えています。

ServeurpersoCom/acestep.cpp

ACE-Step 1.5モデルを使用し、テキスト記述からステレオ48kHzオーディオを生成する、GGMLベースのローカルAI音楽生成サーバー。

High-Logic/Genie-TTS

GPT-SoVITS 向けの軽量な推論エンジン。高速な CPU パフォーマンスと低メモリ使用量に最適化された音声合成を実現します。

elevenlabs/skills

ElevenLabsの音声、音声変換、吹き替え、および音楽生成APIを公開する、すぐに利用可能な「agent skills」のセットです。`npx skills add elevenlabs/skills`でインストールし、APIキーを設定すれば、互換性のあるあらゆるAIコーディングアシスタント(例:text-to-speech, speech-to-text, real-time voice chat, voice-changer, dubbing)からスキルを呼び出すことができます。リポジトリにはPython, JS/TS, および CLI SDKが提供されており、さらにトリガーおよび機能検証用のテストスイートも含まれています。MITライセンスです。

rsxdalv/TTS-WebUI

多種多様なオープンソースのテキスト読み上げ、音声生成、および音声変換AIモデルのための、統合されたウェブインターフェースおよびマネージャー。

argmaxinc/argmax-oss-swift

Core MLを使用して、音声認識、音声合成、話者分離を提供するAppleプラットフォーム向けのオンデバイス推論フレームワークのコレクション。

oboroge0/hayamimi

CPUのみで動作するリアルタイム多言語音声認識システムで、2GB未満のRAMで低遅延のライブ字幕、話者ラベリング、翻訳を提供します。

soaring-xiongkulu/easyaiot

EasyAIoTは、AIビデオ分析、IoTデバイス管理、エンタープライズ統合を統合するオープンソースのクラウドエッジデバイスプラットフォームです。小型エッジボックス(約1GB RAM)で動作し、内蔵RTCモジュールを介してプロフェッショナルIPカメラとコンシューマーP2Pカメラ(Tapo、Tuya、Ringなど)の両方をサポートし、ネイティブYOLO/SAM推論、フェデレーテッドエッジスケジューリング、現場受け入れ用のワンクリックインストーラー(PANEL)を提供します。Linux、Windows、macOS、ARMにインストール可能で、リアルタイム監視とアラート用のWeb、モバイル、SCADAスタイルのダッシュボードを提供します。

Alpha-Dojo/DojoAgents

DojoAgentsは、個人投資向けのオープンソースAIエージェントフレームワークです。大規模言語モデル駆動の「エージェントループ」を実行し、市場データの取得、ニュースの解析、Pythonベースの計算、再利用可能な分析スキルの保存を行います。FastAPIバックエンドとReactダッシュボードにより、ユーザーはポートフォリオメトリクスの閲覧、毎日の市場概要の取得、ニュースインパクト分析、さらにはスクリーンショットからのポートフォリオ診断が可能になります。`uv pip install dojoagents`でインストールでき、OpenAI、Gemini、Anthropic、ローカルのOllamaなど、任意のLLM APIと連携可能。チャットアプリへ自動インサイトを送信することもできます。

Neeeophytee/finding-unknowns-skills

Claude Code、OpenAI Codex、Cursor、Kimi CLI、Hermesなどに対応する13のインストール可能な「スキル」(プロンプトバンドル)のライブラリ。開発者がコード作業の前後で隠れた仮定を浮き彫りにし、エージェントのコンテキストを管理するのを支援します。

melandlabs/openloomi

OpenLoomi は、オープンソースでクロスプラットフォームのデスクトップ「注目力エージェント」です。常にあなたの作業ツール(メール、チャット、イシュー管理ツール、ドキュメントなど)からコンテキストを収集し、検索可能で暗号化された記憶にします。リマインダーを表示し、メッセージアプリ内でLLMに直接助けを求めることが可能です。ランタイムはエージェント非依存で、Claude Code、Codex、OpenCode、Hermes、OpenClawなどと統合可能なスキルとプラグインを提供します。シンプルなバイナリでインストールでき、ローカル優先のプライバシーを重視し、即時動作します。

angelnicolasc/graymatter

GrayMatterはGoで書かれた、LLMエージェント用の単一バイナリメモリレイヤーです。事実を永続的に保存し、デフォルトで上位8件の最も関連性の高いものを取得し、コンテキストトークンを約90%削減します。また、タイプ付き知識グラフを自動構築し、Claude Code、Cursor、Codexなど多数のMCP互換クライアントと統合可能。ターミナルUIとヘルスチェックツールも提供します。`go install`、Homebrew、Scoop、または事前ビルドバイナリからインストール可能。CLI(`graymatter recall`、`remember`、`kg render`など)またはGoライブラリを直接エージェントコードに埋め込むことで利用できます。

receptron/mulmoclaude

MulmoClaudeは、Claude Codeに基づくオープンソースでローカル実行可能なAIアシスタントプラットフォームです。個人の記憶、データコレクション、自動生成された小さなアプリをワークスペース内のプレーンファイルとして保存し、Web UIと数十のメッセージブリッジを提供。安全のためにClaudeをDockerサンドボックス内で実行可能。特徴には個人用ウィキ、会計システム、RSSフィード、Geminiによる画像生成、役割ベースのツールパレット、Claude Codeスキルのワンクリック実行が含まれます。

voquill/voquill

AIによるテキストクリーニングとパーソナル用語集を備え、あらゆるデスクトップアプリケーションへの音声入力(ディクテーション)を可能にする、オープンソースのクロスプラットフォームAI音声入力アプリ。

block/trailblaze

Trailblazeは、LLM駆動のコーディングエージェントが自然言語のステップを通じてAndroid、iOS、およびWebのUIを制御し、それらのステップを記録して決定論的な"treails" (YAMLファイル) としてCIテスト用に保存し、LLMなしでリプレイ可能なCLIです。エージェントスキルファイル、エージェントスキル、ブラウザベースのトレースビューアー、カスタムTypeScriptツール (trailmaps) およびプロトタイプ版のウェイポイントシステムをサポートしています。

elevenlabs/elevenlabs-mcp

ClaudeやCursorのようなAIクライアントが、ElevenLabs APIを使用してテキスト読み上げ、音声クローニング、およびオーディオ処理を行えるようにするMCPサーバー。

thorstenMueller/Thorsten-Voice

オフラインで利用可能でライセンスフリーなテキスト音声変換(TTS)AIモデルを訓練するために使用できる、高品質なオープンソースのドイツ語音声データセットのコレクションです。

vibeeval/vibecosystem

vibecosystem は、Claude Code を自己組織化 AI 開発チームに拡張するオープンソースパッケージです。138 の専門エージェント、296 の再利用可能なスキル、74 の TypeScript フック、20 の行動ルールを搭載しています。1行のインストール後、Claude Code に「機能を追加」などと依頼すると、エージェントの群れが計画・コード・レビュー・テスト・学習を自動で実行します。プロファイル機能で必要なエージェントのみを有効化し、トークン消費を節約できます。`vibeco` CLI と Web ダッシュボードで統計、健全性チェック、トークンコストの追跡が可能です。すべてのデータは `~/.claude/` にローカルに保持され、テレメトリは送信されません。このプロジェクトは Cursor、Codex CLI、OpenCode に対応しており、専用のインストールスクリプトを提供しています。

Torsion-Audio/Scyclone

RAVEアーキテクチャに基づいたニューラル・ティンバー・トランスファー(音色変換)を使用して、オーディオ信号の音質をリアルタイムで変換するオーディオプラグイン。

altunenes/parakeet-rs

parakeet‑rs は、ONNX Runtime を介して NVIDIA Parakeet 音声認識モデル(CTC、多言語 TDT、ストリーミング、話者分離など)を実行する Rust クレートです。タイムスタンプ付き、話者属性付きのオフラインおよびリアルタイム音声認識を提供し、GPU/CPU 実行プロバイダーを選択できます。モデルは Hugging Face から個別にダウンロードされます。ライブラリ自体は MIT/Apache‑2.0 ライセンスです。

olyaiy/resume-lm

ResumeLMは、LLM(OpenAI, Claude, Gemini など)を使用して、ユーザーがATSに最適化された履歴書やカバーレターを執筆、最適化、およびエクスポートできるようにするオープンソースのウェブアプリです。Next.js 15, Supabase/PostgreSQL, および Stripe で構築されており、無料プランと、プレミアムモデルへのアクセスが可能な月額$20の Pro プランを提供しています。

xcLee001/SonicVale

小説や脚本向けのマルチキャラクター・マルチ感情音声合成を自動化するオープンソースAIボイスオーバープラットフォーム。

microsoft/Multi-Agent-Custom-Automation-Engine-Solution-Accelerator

複雑なビジネスワークフローの自動化を実現する、Microsoft Azureベースのリファレンスソリューション。Azure OpenAI(Foundry)、Container Apps、Cosmos DB、その他のAzureサービスを統合し、デプロイガイド、コストガイド、セキュリティ推奨事項を含んでいます。

mlco2/ecologits

EcoLogits は、生成系 AI API(OpenAI、Anthropic、Cohere など)への呼び出しにおける電力消費と CO₂‑当量排出量を推定する Python ライブラリです。`pip install ecologits`(必要に応じてプロバイダー extras を追加)でインストールし、`EcoLogits.init` で初期化、通常通り API を呼び出した後に `response.impacts.energy.value.mean` と `response.impacts.gwp.value.mean` で推定 kWh と kg CO₂‑eq を取得できます。オープンソースで CodeCarbon の非営利団体の一部であり、AI 推論の環境影響を開発者が追跡・削減できるよう支援します。

mudler/parakeet.cpp

NVIDIA の NeMo Parakeet 話音認識モデルの C++17 推論ポートで、Python を必要とせず、CPU および GPU 上で高速かつ依存関係の少ない ASR を実現します。

HoangNguyen0403/agent-skills-standard

Agent Skills Standard (AGS) は、NPM経由で配布されるCLIで、開発チームがコーディング規準、セキュリティルール、SDLCワークフローテンプレートを小さなMarkdown「スキル」として公開できます。CLI(`ags init` / `ags sync`)は `.skillsrc` 設定ファイルを作成し、言語固有のスキルパック(20以上のスタックで合計280スキル)をダウンロードし、階層的なルーター(`AGENTS.md → _INDEX.md → SKILL.md`)を生成します。AIコーディングアシスタント(Cursor、Claude Code、Copilot、Geminiなど)はこのルーターを読み、編集中のファイルに該当するルールのみを読み込み、プロンプトトークンを約85%削減します。オプションのMCPサーバーでフックの強制、シークレット漏洩編集のブロック、実行時監査ログの提供が可能です。このプロジェクトは、汎用的なチュートリアルやリストではなく、本格的なAIコーディングアシスタントユーティリティです。

WecomTeam/wecom-openclaw-plugin

OpenClaw AIエージェントプラットフォーム用のWeComチャネルプラグイン。Bot(WebSocketまたはJSON Webhook)およびAgent(暗号化XML Webhook)接続を追加し、リッチメディア、プロアクティブおよびストリーミング返信、細かいアクセス制御、複数アカウント設定をサポート。また、組み込みの `wecom-cli` ツールで、メッセージ、メール、ドキュメント、スプレッドシート、カレンダー、会議、ファイルストレージ、連絡先など数十のWeComビジネスAPIをAIが呼び出せるようにします。

karanb192/itr-wala

itr‑walaは、インドの個人所得税申告書をローカルで準備するオープンソースのCLIです。 LLMはPDFの読み取りにのみ使用され、すべての法定計算は徹底的にテストされたPythonエンジンが行います。 このツールは入力を検証し、旧制度と新制度を比較し、入力準備が整った申告パックを出力します。 最終的な提出と支払いは、政府ポータルで手動で行う必要があります。

mylxsw/typeflux

あらゆるアプリに超高速の音声からテキストへの入力を提供するmacOSアプリケーションで、プライバシーと速度を考慮してローカルとクラウドベースのAIモデルの両方をサポートしています。

MTG/essentia

音声分析および音楽情報検索のためのオープンソースの C++ および Python ライブラリ。幅広い信号処理アルゴリズムと音楽記述子を提供します。

justrach/codedb

codedb はゼロ依存の Zig ベースサーバーであり、ローカルコードベースの豊富なインデックス(3文字語素、単語、シンボル、コールグラフ)を構築し、Model Context Protocol(stdio上のJSON-RPC)を通じて公開します。AIコーディングアシスタント(Claude Code、Cursor、Gemini CLI など)は、ファイルツリー、アウトライン、シンボル定義、コール元、全文検索をミリ秒未満の遅延で取得でき、トークン使用量を劇的に削減します。MCPデーモン(`codedb mcp`)またはHTTPサーバーとして実行でき、ファイルウォッチャーによる増分更新が可能で、macOS、Linux、Windows用の署名済みバイナリを提供しています。

HiMeditator/auto-caption

ローカルまたはクラウドベースのAIモデルを使用して、システムオーディオまたはマイク入力からリアルタイム字幕と翻訳を生成する、クロスプラットフォームのリアルタイムキャプションソフトウェアです。