VOICEVOX/voicevox_engine

VOICEVOX Engineは、VOICEVOX日本語TTSコアをラップするオープンソースHTTPサーバーです。RESTエンドポイントを介してテキスト(または詳細な合成クエリ)を送信し、WAV音声を取得できます。ストリーミング、ユーザー辞書、プリセット、ボイスモーフィング、歌唱合成、オプションのGPUアクセラレーションをサポート。Dockerイメージとモックモードによりデプロイが容易で、APIは `/docs` でドキュメント化されています。

joeynyc/hermes-hudui

Hermes AIエージェントのメモリ、コスト、内部状態の可視化を提供するブラウザベースの監視ダッシュボード。

lucidrains/transfusion-pytorch

テキストの次トークン予測と、画像などの連続的モダリティのフローマッチングを1つのモデルで統合する PyTorch 実装。

CloudAI-X/claude-workflow-v2

Claude Code およびその他の AI エージェント向けのユニバーサルワークフロープラグイン。専門エージェント、スラッシュコマンド、自動化フックを提供し、ソフトウェア開発をスムーズにします。

google-deepmind/android_env

Androidデバイス(またはエミュレータ)を強化学習(RL)環境に変換するPythonライブラリ。エージェントがタッチスクリーン操作を通じてOSやアプリをナビゲートする学習を可能にします。

alibaba/Tora

Toraは、テキスト、視覚、軌道ベースのガイドを使用して、オブジェクトの動きを正確に制御できる軌道指向型拡散変換器(Diffusion Transformer)による動画生成を可能にする。

automl/SMAC3

機械学習アルゴリズムに対して、最適なハイパーパラメータ構成を効率的に見つけるために設計された、多用途なベイズ最適化パッケージ。

okisdev/ChatChat

複数の主要AIプロバイダーへのアクセスを1つのインターフェースで提供する統合型、セルフホスト型チャット・検索プラットフォーム。

aws/deep-learning-containers

AWS上でAI/MLワークロードを実行するための事前構築済みかつセキュリティパッチ適用済みDockerイメージのコレクション。PyTorch、TensorFlow、vLLMなどのフレームワーク向けに最適化された環境を提供します。

openvinotoolkit/nncf

NNCF(Neural Network Compression Framework)は、PyTorch、TorchFX、ONNX、OpenVINOモデルに事後訓練および訓練時圧縮(量子化、重み圧縮、削減など)を追加するオープンソースのPythonライブラリであり、精度の損失を最小限に抑えつつ、より小さく高速な推論を実現します。

ros-visualization/rviz

rvizは、ロボットオペレーティングシステム(ROS)フレームワーク向けの3Dビジュアライザーであり、開発者がロボットのデータを3Dで確認できるようにします。

Fadi002/de4py

ローカルLLMとASTクリーニング、パターンマッチングを組み合わせた高度なPythonデオブフスケータ。マルウェアアナリストやリバースエンジニアが読みやすいコードを回復するのを支援します。

landing-ai/ade-python

LandingAI ADE API用のPythonライブラリ。PDFおよび画像を構造化されたMarkdownに変換し、Pydanticモデルを使用して型付きデータを抽出する。

allenv0/AirPosture

AirPodsのヘッドトラッキングとローカルAIを使用して、首の負担を軽減するためのリアルタイムな姿勢コーチングと通知を提供するiOSアプリ。

wangziqi06/724-office

純粋なPythonで構築された、マルチテナントルーティングと3層メモリシステムを備え、24時間365日のパーソナルアシスタンスを提供するフレームワークフリーの自己進化型AIエージェントシステム。

langwatch/scenario

シミュレーション、ユーザーシミュレーター、ジャッジエージェントを使用して、マルチターン会話における AI エージェントの動作と堅牢性を評価するエージェントテストフレームワーク。

beizhu-1209/AIHelms

中央集権的なアイデンティティと予算追跡を通じて、AIコストの管理、モデルアクセスの制御、AI生産性の定量的評価を可能にするエンタープライズAIリソース管理プラットフォーム。

google-deepmind/xmanager

ローカル環境、Kubernetes、Google Cloud Platform における機械学習実験のパッケージ化、実行、追跡のためのフレームワーク。

nengo/nengo

Nengoは、スパイク型および非スパイク型のシミュレーションの両方をサポートする、大規模な神経モデルの構築とシミュレーションのためのPythonライブラリです。

microsoft/typeagent-py

構造化RAGシステムを構築するためのTypeAgent KnowProのPython実装。構造化検索の実験的プロトタイプとして機能します。

SeldonIO/MLServer

さまざまなフレームワークに対応する機械学習モデルを標準化されたRESTおよびgRPCインターフェースで配信するオープンソースの推論サーバー。

ls1intum/Artemis

大学向けにスケーラブルな個別フィードバック、自動評価、およびオプションの LLM ベースのチュートリアルを提供するオープンソースプラットフォーム。

sangrokjung/claude-forge

Claude Forge は、基本的な Claude Code ターミナル型コーディングアシスタントをプロダクションレベルの開発環境に変えるプラグインパックです。16の専門AIエージェント、35のスラッシュコマンド、33の保存済み「スキル」、22のセーフティフック、14の行動ルール、4つの外部ツール接続を追加します。1行スクリプト(フルインストール)または Claude Code のプラグインマーケットプレイス(コマンドのみ)でインストール可能。このパックは計画、テスト最優先開発、セキュリティレビュー、ドキュメント同期、および独立したエージェントによる承認を要する敵対的検証ループを自動化します。MITライセンス、v4.3.0(2026年9月)で積極的にメンテナンス中。

kyegomez/Open-AF3

タンパク質、核酸、リガンドを含む生体分子相互作用の3次元構造を予測するためのオープンソースPyTorch実装であるAlphaFold 3。

lucasjinreal/Kokoros

CLI、Rustクレート、およびOpenAI互換APIサーバーを介して高速なテキスト読み上げ合成を提供する、Kokoro TTSモデルの高パフォーマンスなRust実装。

go-kratos/blades

Go言語向けのマルチモーダルAIエージェントフレームワーク。プラグイン可能なモデル、ツール、メモリを備え、複雑なAIワークフローの構築を可能にする。

fishaudio/fish-diffusion

マルチスピーカー学習と効率的なハードウェア利用をサポートする、Text-to-Speech、Singing Voice Synthesis、Singing Voice Conversion向けのDiffusionベースのトレーニングフレームワーク。

Kevin-thu/StoryMem

StoryMemは、メモリ条件付き拡散モデルを用いて、一貫したキャラクターを備えた長編で連続性のあるナラティブ動画を生成するマルチショット動画生成フレームワークです。

TechStark/opencv-js

Node.jsおよびWebブラウザでOpenCVコンピュータビジョンライブラリを提供するNPMパッケージ。JavaScriptでリアルタイム顔検出などのタスクを実行可能。

weecology/DeepForest

ディープラーニングによるオブジェクト検出を用いて、空中RGB画像における木の冠や鳥などの生態的対象物の学習および予測を行うPythonパッケージ。

DoubleML/doubleml-for-py

scikit-learn を使用してバイアスを低減する構造的パラメータを推定するための、二重/バイアス補正機械学習フレームワークを実装した Python パッケージ。

knostic/OpenAnt

二段階の検出と攻撃プロセスを通じて、ソースコード内のセキュリティ上の欠陥をLLMベースで発見し、検証するツール。

infinilabs/coco-app

Google Workspace、Dropbox、GitHub などのアプリから企業データを統合し、単一のインターフェースで検索とAIチャットを提供する統合検索およびAIチャットプラットフォーム。

ckreiling/mcp-server-docker

自然言語コマンドを使用して、LLMがDockerコンテナ、イメージ、ボリュームを管理できるようにするMCPサーバー。

HKUSTDial/flash-sparse-attention

Flash Attention のメモリ効率とスパース計算を組み合わせた、極めて長いシーケンスを扱う Transformer における高性能でトレーナブルなスパースアテンション実装。

NVIDIA/torch-harmonics

球面上での微分可能な信号処理のためのPyTorchライブラリ。球面調和変換と物理ベースAI用のニューラルオペレータを可能にします。

vybestack/llxprt-code

開発者がローカルモデルや既存のサブスクリプションを含むあらゆるLLMプロバイダーを使用して、コードベースの編集やワークフローの自動化を行える、プロバイダーに依存しないCLI AIコーディングアシスタントです。

meta-pytorch/torchforge

インフラの関心事とモデルの関心事を分離することで、スケーラブルな強化学習の実験を簡素化する、PyTorchネイティブのエージェント型RLライブラリ。

lyon-industries/graphrag-workbench

Microsoft GraphRAG を視覚インターフェースでラップし、ドキュメントを検査可能な 3D 知識グラフに変換するローカルワークベンチ。

innocommerce/innoshop

Laravel 13 を基盤とするオープンソースの電子商取引システムで、AIモデルと Model Context Protocol (MCP) を統合し、インテリジェントな自動化を実現しています。

moeru-ai/xsai

ブラウザ、エッジ、およびエージェントツール間で高いポータビリティと最小限のバンドルサイズを実現するように設計された、軽量なOpenAI互換AI SDK。

OpenSenseNova/SenseNova-Vision

SenseNova-Vision は、多様なコンピュータビジョンタスクを生成問題として扱う統合マルチモーダルモデルであり、単一のモデルでテキストと画像の出力を通じて検出、セグメンテーション、および幾何学的予測を実行できます。

Railly/tinte

AIコーディングエージェントがブランドに合ったUIを記述できるように、デザインシステムをインストール可能なエージェントプラグインにコンパイルするツールです。特定のデザイントークンと構成ルールに従って、一貫性のあるUIを生成できます。

zjx0101/ObjectClear

ObjectClearは、ターゲットオブジェクトとその関連効果(影など)を同時に除去しつつ、背景の一貫性を維持するオブジェクト除去モデルです。

BGU-CS-VIL/WTConv

CUDA、Metal、Triton 用に最適化されたバックエンドを備えた、CNN に大きな受容 field を提供するウェーブレット畳み込みを実装するライブラリ。

MaxGfeller/open-harness

Vercel の AI SDK を基盤としたフレームワークで、ツール使用、セッション管理、合成可能なミドルウェアを内蔵した汎用 AI エージェントの構築を可能にします。

vivekVells/mcp-pandoc

Pandoc を使用して、Markdown から PDF および DOCX まで、さまざまなフォーマット間でドキュメントを変換できる MCP サーバーです。

PKU-Alignment/safety-gymnasium

安全制約付きAIエージェントの評価に使用できる標準化された環境セットを提供する、スケーラブルでカスタマイズ可能な安全強化学習ベンチマークライブラリ。