URUWorks/TeroSubtitler
プロフェッショナルな字幕作成のために、AI音声認識、翻訳、ダブリングツールを統合したオープンソースでクロスプラットフォーム対応の字幕編集ツール。
LibreSpark/LibreTTS
300以上の音声をサポートし、カスタムのOpenAI互換TTS APIとの統合を可能にする無料のオンラインテキスト読み上げツール。
MoizIbnYousaf/ai-agent-skills
AI Agent Skillsは、約115個の厳選されたAIエージェント「スキル」(プロンプトとコードのセット)を、棚(フロントエンド、バックエンド、モバイル、ワークフロー、エージェントエンジニアリング、マーケティング)に整理して提供するnpmベースのCLI/TUIです。ローカルの「house-copy」スキルと、メタデータのみの上流(upstream)スキルを、閲覧、検索、インストール、管理することができます。また、`init-library`を使用して、個人のライブラリを立ち上げ、新しいスキルの追加、カタログ化、ベンダー化、更新の同期、ドキュメント生成も可能です。Claude、Cursor、GeminiなどのあらゆるAgent-Skills互換エージェントで動作し、複数のインストール先をサポートしています。再利用可能なエージェント能力の整理された検索可能なツールボックスを求めている開発者やチームに最適です。
xzf-thu/Mega-ASR
Mega-ASRは、ノイズ、エコー、歪みの音響シミュレーションを拡大することで、困難な現実世界の環境における堅牢な音声認識を実現する基盤ASRモデルです。
Ashutosh0x/rust-finance
RustFinance Terminal (Rust‑Forge) は、リアルタイム市場データインジェスト(直接取引所バイナリーフィード、ブローカーAPI、暗号資産WebSocket)、フルスクリーンターミナルUI、Claude駆動のAIコメント、マイクロ構造指標、リスクモデル、実行アルゴリズム(TWAP、VWAP、Almgren‑Chrissなど)を統合したオープンソース、Rust専用の取引プラットフォームです。ナスダック/NYSEネイティブ接続、モジュール化されたcrateアーキテクチャ、研究レベルのドキュメントを備え、定量研究者、低遅延開発者、AI愛好家をターゲットとしています。
DataArcTech/DataArc-SynData-Toolkit
DataArc SynData Toolkitは、1つのYAML設定ファイルでLLM用の合成学習データ(テキストまたは画像+テキスト)を生成し、SFT/GRPOでモデルをファインチューニング、DeepEvalで評価できるオープンソースPythonフレームワーク。CLIまたはFastAPI + React GUIからアクセス可能。
derisk-ai/OpenDerisk
OpenDeRiskは、ソフトウェアのインシデントに対する根本原因分析(RCA)を自動化するオープンソースのマルチエージェントAIプラットフォームです。大規模なOpenRCAデータセットを読み込み、専門化されたエージェント(SRE, Code, Report, Visual, Data)が連携して、Web UIを通じて可視化されたエビデンスチェーンを可視化します。curl スクリプトまたはuv パッケージマネージャーを使用してソースからインストール可能で、クイックスタート、フレームグラフ(flame-graph)支援、対話型データ分析をサポートします。
apache/texera
Apache Texeraは、ドラッグアンドドロップGUIを通じてデータ分析パイプラインを構築・実行できるオープンソースの視覚プラットフォームであり、自然言語コマンドをワークフローステップに翻訳するAIエージェントを備えています。PythonおよびJava演算子をサポートし、リアルタイム共同作業、インタラクティブデバッグが可能で、ラップトップから大規模クラウドクラスタまでスケーラブルです。
senstella/parakeet-mlx
Apple Silicon向けにNvidiaのParakeet ASRモデルをMLXベースで実装したもので、ストリーミングとタイムスタンプのサポートを備えた効率的なローカル音声文字起こしを提供します。
MobiusQuant/OpenMobius-skill
OpenMobius‑skillは、AIコーディングエージェント(Claude Code、Codex、OpenClaw、Hermes、Cursor、WorkBuddy)向けのプラグインで、厳選されたトレーディング知識ベース(ICT、SMC、チャンルンなどから約2,000カード)、リアルタイム市場データ、60以上のテクニカル指標、チャート生成を追加します。ユーザークエリをstrict/augment/compareモードでルーティングし、複数の分析スクールをサポートし、独自のPython仮想環境、モデルウェイト、Playwright Chromiumで自己完結型にインストールされます。
gnh1201/welsonjs
WelsonJSは、Windows専用のフレームワークで、組み込みのWindows Script Hostエンジンを使用してJavaScript(およびTypeScript、CoffeeScriptなど)でコンソールまたはGUIデスクトップアプリを記述できます。追加ランタイムは不要で、レガシーWindowsバージョンに対応し、jQuery、Monaco、React、ESENTデータベース、ネイティブWindowsサービスAPIなど多数のライブラリをバンドル。オプションでChatGPT、GeminiなどのLLM統合も可能。アプリはzipファイル、Inno Setupインストーラ、または単純なコピー&実行バンドルとしてパッケージ化でき、PowerShellブートストラップスクリプトでランタイムを自動取得できます。
NVIDIA/cudf-spark
NVIDIA cuDF plugin for Apache Sparkは、SparkのCPU DataFrame操作をcuDFに置き換えることで、結合、集計、その他のSQLスタイルのクエリを高速化するGPU加速ライブラリです。バニラなSparkと同一の結果を提供し、Sparkプラグインとして統合、他のGPU MLライブラリへのゼロコピー・データパスを提供し、ユーザーがパフォーマンスを評価・チューニングするための適格性評価およびプロファイリングツールを備えています。
defendend/Claude-ast-index-search
ast-index は、マルチ言語コードベース用のSQLite ASTインデックスを構築するCLIで、シンボル、クラス、依存関係などの高速な構造クエリを可能にします。LLMのトークン使用量を削減し、Claude、Codex、Cursor、Geminiのプラグイン経由で統合され、モノレポ、増分更新、豊富なJSONスキーマをサポートします。
x-pai/AlphaBot
AlphaBot は、LLM 駆動のチャットアシスタントとリアルタイム市場データ(グローバル市場は Alpha Vantage、中国 A 株は Tushare/AKShare)を組み合わせた、オープンソースで Docker デプロイ可能な Web アプリです。AI 生成のテクニカル分析とファンダメンタル分析、チャート可視化、リスク評価、個人投資家向けの簡単なクオンツ戦略提案を提供します。
BeaconBay/ck
ckは、Rustで作られたCLI/TUIツールで、ソースコードのローカル埋め込みを構築し、意味(意味ベース検索)で検索できるようにします。従来の正規表現検索と併用でき、インクリメンタルインデックス、複数の埋め込みモデル、AIエージェント統合(MCPサーバー経由)、自動化用にJSON/JSONL形式の出力をサポートします。
provos/ironcurtain
IronCurtainは、平易な英語による「憲法」を決定論的な許可/拒否ルールにコンパイルし、検証してポリシー・エンジンですべてのツール呼び出しに強制する研究段階のランタイムです。V8サンドボックスまたはDockerで隔離されたエージェントをサポートし、エスカレーション処理用のインタラクティブなターミナルマルチプレクサとオプションのWeb UIを提供。マルチエージェントパイプライン用のペルソナ/ワークフロー機能も備えています。
openvinotoolkit/nncf
NNCF(Neural Network Compression Framework)は、PyTorch、TorchFX、ONNX、OpenVINOモデルに事後訓練および訓練時圧縮(量子化、重み圧縮、削減など)を追加するオープンソースのPythonライブラリであり、精度の損失を最小限に抑えつつ、より小さく高速な推論を実現します。
aTrainTranscription/aTrain
aTrain は、あなたのコンピュータ上で Whisper(faster-whisper を経由)をオフラインで実行する音声認識アプリです。スピーカー・ディアライゼーション、99言語対応、MAXQDA、ATLAS.ti、NVivo と互換性のあるエクスポート形式を提供します。Linux/Windows 向けデスクトップアプリとして配布され、pip でインストール可能な CLI バージョンも用意されており、CUDA GPU によるオプションのアクセラレーションで処理速度を向上させられます。
zilliztech/VectorDBBench
VectorDBBenchは、多くのオープンソースおよびクラウドベクターデータベースにおける挿入、ベクタ検索、フィルタ検索、および全文BM25取得のパフォーマンスをベンチマークするPython CLIツールです。標準的なANNデータセット(SIFT、GIST、Cohere、OpenAI埋め込み)と新しいマルチモーダルHugging Faceデータセットを内蔵しており、レイテンシ/リコール/QPSおよびクラウドコストを報告し、結果の比較に使えるビジュアルUIを提供します。
woheller69/whoBIRD
6,000 種以上の鳥の種類を、リアルタイムで完全にオフラインで音声から機械学習で識別する Android アプリ。
zh-plus/openlrc
faster-whisper を使用して音声を認識し、LLM を使ってテキストを翻訳・仕上げて同期 `.lrc` 字幕に変換する Python ライブラリ。
gmickel/flow-next
Flow‑Nextは、コーディングエージェント(Claude Code、OpenAI Codex、Cursorなど)向けのプラグインで、変更リクエストを永続的な仕様書に変換し、その後、計画、実装、敵対的レビュー、ライブQA、PR作成を自動的に推進し、すべての証跡をリポジトリに記録します。
Hao0321/claude-skill-social-post
Claude/Codex スキルで、制御された Chrome セッションを介して Facebook、Instagram、Threads でのソーシャルメディアコメントの下書き、レビュー、(オプションで)投稿を可能にします。ブランドの声を学習し、すべての操作を暗号的に署名されたレジャーデータに記録し、広範な安全チェックとテストスイートを備えています。ライブ投稿はデフォルトで無効です。リポジトリは自動化フレームワークを提供するものであり、プライベートコンテンツは含まれません。
MatthewCYM/VoiceBench
VoiceBench は、LLMベースの音声アシスタントを評価するためのベンチマークスイートです。音声駆動型 QA および指示追従タスクを備えた Hugging Face データセットを提供し、モデルを実行し、音声応答を収集して自動スコアリングする(GPT-4o-mini を使用)コマンドラインツールキットも提供します。結果は公開リーダーボードに掲載され、リポジトリには最近の音声アシスタント関連論文のリストも含まれています。
Xerophayze/TTS-Story
多数のローカルおよびクラウドベースの音声エンジンをサポートするウェブベースのマルチボイスTTSアプリケーション。ナラティブストーリーやオーディオブックの制作に最適。
pluja/whishper
FasterWhisperを使用して高速かつプライベートな処理を実現する、Web UIを備えた100%ローカルのオープンソース音声文字起こし・字幕作成スイート。
wenet-e2e/wenet
ストリーミングおよび非ストリーミング音声認識のための本格的なエンドツーエンド音声認識ツールキット。
PaddlePaddle/PaddleSpeech
PaddlePaddle プラットフォーム上の、音声認識、合成、および翻訳のための最先端モデルを提供するオープンソースの音声・音声ツールキット。
lukaszliniewicz/Pandrator
ローカルおよびクラウドベースの音声・言語モデルを調整することで、オーディオブック、字幕、ナレーションを作成するための統合ワークスペース。
shinpr/claude-code-workflows
Claude Code Development Workflows は、Claude AIアシスタントを構造化された開発パイプラインに変える、Claude Codeプラグインのセットです。プラグインは「レシピ」(例:`/recipe‑implement`、`/recipe‑design`、`/recipe‑review`)を提供し、成果の合意、設計文書化、作業計画生成、タスクレベルの実装と自動検証、独立したセキュリティレビューを強制します。バックエンド、Reactフロントエンド、フルスタックプロジェクトに対応する3つのプラグインファミリーがあり、Claudeのマーケットプレイスからインストール可能です。繰り返し可能なセーフティゲートと設計からコード生成への正式な引き渡しが必要な場合に有用です。素早いプロトタイプ作成の場合はスキップ可能です。
junjiem/dify-plugin-repackaging
GitHub Actions、Docker、または直接シェルスクリプトで使用可能な、Dify AI プラットフォームのプラグインをダウンロードし、異なる OS/アーキテクチャ向けに再パッケージ化するユーティリティ。
AdamPlatin123/dsh-plugin-radar
DSH Plugin Radar は、DeepSeek Harness プラグインを自動的に発見・検証(Kubernetesポッド経由)・カタログ化するオープンソースシステムです。ライブなMarkdownリスト、カスタマイズされた「おすすめ」リスト、バンドルコレクション、パブリックJSON APIを生成し、開発者やユーザーが試行錯誤なしに信頼できるDSHプラグインを見つけるのを支援します。
linkerlin/PUAX
PUAXは、LLMエージェントにマインドセット層を追加する本番対応ランタイムです。アリーナ/ゲート/ドリームプリミティブ、シンプロンプト圧縮、ゼロ依存Python SDK、ハイブリッドトリガー検出、59の組み込み(およびカスタム)ロール、成果駆動型検証、人間を標的とした操作検出のためのカーボンシールド、再現可能なマルチモデルベンチマークスイートを提供します。システムはMCPサーバー(`npx puax-mcp-server`)を介してアクセスされ、人気のIDEにネイティブフックを注入し、ワンラインAMPミドルウェアを介してLangChain/AutoGenに直接埋め込むことができます。MITライセンスで本番対応とマークされています。
Chozzc/Lujie-Careerkit
LuJie CareerKitは、履歴書管理、JD(職務記述書)マッチング、面接準備、模擬面接、および応募管理を強化するAI搭載Webアプリです。データはすべてSQLiteにローカル保存され、設定可能なOpenAI互換モデルを使用し、自然言語コマンドで求職関連資料の生成・編集ができる実験的なアプリ内キャリアエージェント機能を備えています。
getkimchi/kimchi
kimchi は pi‑mono SDK に基づくターミナルベースのAIコーディングアシスタントです。1つ以上のLLMを役割(プランナー、ビルダー、レビュアー、エクスプローラー、リサーチャー)に分担させ、マルチモデルルーティング、Fermentによる永続的プロジェクト管理、タグベースの使用状況追跡、オプションのLSP統合、リモートセッションのテレポートをサポートしています。
sangrokjung/claude-forge
Claude Forge は、基本的な Claude Code ターミナル型コーディングアシスタントをプロダクションレベルの開発環境に変えるプラグインパックです。16の専門AIエージェント、35のスラッシュコマンド、33の保存済み「スキル」、22のセーフティフック、14の行動ルール、4つの外部ツール接続を追加します。1行スクリプト(フルインストール)または Claude Code のプラグインマーケットプレイス(コマンドのみ)でインストール可能。このパックは計画、テスト最優先開発、セキュリティレビュー、ドキュメント同期、および独立したエージェントによる承認を要する敵対的検証ループを自動化します。MITライセンス、v4.3.0(2026年9月)で積極的にメンテナンス中。
a-agmon/rs-graph-llm
graph-flow は、AIエージェント向けの状態保持型グラフベースワークフローを構築できるRustライブラリです。Taskは型付きContextを読み書きでき、エンジンは人間の入力を待機、セッションの永続化(インメモリまたはPostgreSQL)、後続の再開を可能にします。条件付きエッジ、並列ファンアウト、オプションのRig統合(LLM呼び出し)を備えています。保険請求、推薦など実世界の例サービスも提供。MITライセンスでcrates.ioに公開されています。
alantech/marsha
Marsha は LLM で駆動される、マークダウンスタイルの言語です。型、自然言語による仕様、入出力の例を用いてデータ処理関数を記述できます。Marsha コンパイラはこの仕様を LLM に送信し、Python コードを生成、例に基づいて検証し、実行可能な CLI または REST サービスを生成します。
alesaccoia/VoiceStreamAI
WebSockets、音声活動検知(VAD)、および Faster Whisper を使用した、ニアリアルタイムのオーディオストリーミングと文字起こしのための Python および JavaScript ソリューション。
DavidDiazGuerra/gpuRIR
画像源法を用いたGPUアクセラレーテッドなPythonライブラリで、部屋インパルス応答(RIR)をシミュレート。CPU実装と比較して最大100倍の高速化を実現。
ScottZt/jin-ce-zhi-suan
Pythonベースの定量取引プラットフォームで、「三省六部」モデル(唐代官僚制度にインスパイア)を採用。バックテスト、マルチ戦略管理、リスク最優先実行、AI駆動の自然言語株式スクリーニング機能を提供。FastAPI + HTMLダッシュボードで動作し、複数のデータソースに対応。個人・学術利用は無料(商業利用にはライセンスが必要)。
AddictedCS/soundfingerprinting
音声および動画の指紋認識を可能にするC#フレームワークで、音響的および動画的ハッシュを通じてメディアコンテンツの高速識別を実現します。
OHF-Voice/wyoming
音声入出力、ウェークワード検出、音声認識(ASR)、テキスト音声変換(TTS)サービス間の通信を標準化するピアツーピアTCPプロトコル。
ElectricCodeGuy/SupabaseAuthWithSSR
本格的なNext.js 16スターターで、Supabase SSR認証とClaude駆動チャットを統合。RAG、ウェブ検索、チャート、PDF生成、記憶、アーティファクトワークスペース、使用状況ダッシュボード、管理者コンソールの8つの組み込みAIツールを備える。単一ファイルのSupabaseスキーマ、トークン単位のコスト追跡、キャッシュにより、SaaSや社内AIアシスタントとして即時利用可能。
meta-pytorch/captum
Captumは、開発者や研究者が、どの入力、ニューロン、または学習データがモデルの予測を駆動しているのかを理解するための、PyTorch用モデル解釈性アルゴリズムのスイートを提供します(Integrated Gradients, DeepLift, Gradient Shap, SmoothGrad, TCAV, TracIn, ニューロン/層のコンダクタンスなど)。pip/condaでインストール可能で、あらゆる PyTorch モデルと動作します。
common-voice/common-voice
音声認識関連ツールのトレーニング用パブリックドメインデータセットを作成するため、音声寄付を収集するウェブアプリケーション。
AndersonBY/vector-vein
VectorVeinは、コードを書かずにAI駆動の自動化ワークフローを構築できるクロスプラットフォームの無コードデスクトップアプリです。LLM呼び出し、埋め込み、音声認識などを視覚的に接続でき、OpenAI互換エンドポイント(OpenAI、Ollama、LM‑Studioなど)をサポート。プログラムによる実行を可能にするローカルFastAPI REST APIを備え、pywebviewで構築された単一実行可能ファイルとして配布されます。
iot-salzburg/gpu-jupyter
GPU‑Jupyterは、Python、PyTorch、TensorFlow、Julia、Rが事前にインストールされたDockerベースのGPU対応JupyterLab環境です。バージョン管理されたイメージ、カスタマイズのしやすさ、Docker‑Compose対応を備え、NVIDIA GPUを搭載した任意のマシンで再現可能なディープラーニング実験を可能にします。