AlekPet/ComfyUI_Custom_Nodes_AlekPet

ComfyUI用のカスタムノードのコレクションで、プロンプト翻訳、AI駆動コンテンツ生成、画像操作ツールを追加します。

TalAter/annyang

音声認識を使用して、音声コマンドでウェブサイトを操作できるようにする軽量なJavaScriptライブラリ。

MatteoFasulo/Whisper-TikTok

OpenAI-WhisperとEdge TTSを使用して、自然なナレーション付きの字幕入りTikTok動画を自動生成するAIツール。

lenML/Speech-AI-Forge

ChatTTS、CosyVoice、Whisperを含む複数のTTSおよびASRモデルに対して、一元化されたインターフェースを提供する統合フレームワークおよびAPIサーバー。

duoan/mega-data-factory

Web規模のマルチモーダルデータセットを処理するための、Rust加速オペレーターを備えた分散型・高スループットパイプライン。

UfoMiao/zcf

ZCFは、Claude CodeとCodexのワンクリック初期化を提供するゼロコンフィグ・セットアップツールであり、ワークフロー、API、およびエージェントシステムの構成を自動化します。

EvolvingAgentsLabs/evolving-agents

パフォーマンスの低下を防ぐために、コード、目的、トレースをバージョン管理できる、Claude Agent SDK プラグインとしてのバージョン管理システムとAIエージェント用SDK

mratsim/Arraymancer

Nim 用の高性能 n 次元テンソルライブラリで、CPU、CUDA、OpenCL バックエンド上での科学計算、機械学習、深層学習のためのツールを提供します。

SerialLain3170/AwesomeAnimeResearch

アニメおよびカートゥーン生成に焦点を当てた、画像合成からアニメーション制作までを網羅する研究論文とデータセットの厳選されたコレクション。

asyml/texar

Texar は NLP とテキスト生成のためのモジュール式ツールキットで、使いやすい機械学習モジュールと事前学習済みモデルを提供し、迅速なプロトタイピングと実験を可能にします。

Orkas-AI/Orkas-VideoStudio

読みやすく編集可能なプランファイルを通じて、AIコーディングエージェントが動画の構成、編集、生成を行うことを可能にするツールキット。自動動画制作の決定論的パイプラインを提供します。

FullAgent/fulling

Fulling は、ランタイム、メモリ、スキルを安全な Kubernetes ベースの認証境界内に統合した、専用 AI ワークスペース構築のための基盤です。

crabtalk/crabtalk

AIエージェントを実行し、ツールをディスパッチし、MCPサーバーに接続するエージェントデーモン。安全なツール実行のために制限されたharnessesを使用します。

opea-project/GenAIExamples

多様なハードウェアプラットフォーム上で GenAI アプリケーションの拡張とテストを簡素化するために設計された、マイクロサービスベースの生成 AI の例とデプロイガイドのコレクションです。

google-deepmind/dm_pix

PIXは、JAXベースの画像処理ライブラリであり、GPU/TPU加速機能(例:反転、リサイズ)を提供します。`jax.jit`でコンパイル、`jax.vmap`でベクトル化、または`jax.pmap`で複数デバイス上で実行可能です。まずJAXをインストールし、次に`pip install dm-pix`を実行してください。NumPyの画像処理コードと同様に利用可能ですが、JAXのフルパフォーマンスと自動微分機能を利用できます。

flytohub/flyto-core

AIエージェント向けのPython実行エンジンで、ワークフローのすべてのステップを記録し、失敗したステップから再実行・再開できるようにすることで、全体のプロセスを再起動する必要をなくします。

hysts/anime-face-detector

PyTorch ベースのツールで、事前学習済み Faster R-CNN、YOLOv3、HRNetV2 モデルを使用してアニメ顔を検出し、28 個の顔ランドマークポイントを推定します。

RaoFoundation/bittensor

機械知能およびその他のデジタル商品に対して競争的な市場を創出するための、ブロックチェーンベースのインセンティブシステムによって報酬が与えられる分散型プラットフォームおよび SDK です。

callstackincubator/cali

React Native と Expo チーム向けのロール指向 CLI で、AI エージェントを使ってモバイル QA、パフォーマンスレビュー、実装を自動化します。

openonion/connectonion

プロダクション対応のAIエージェントを構築・デプロイするためのテンプレート優先のフレームワーク。組み込みツール、チャットインターフェース、高度なデバッグ機能を提供します。

agentic-in/inferoa

ループエンジニアリング向けに設計された、推論ネイティブなエージェント。トークン使用とキャッシュ再利用を最適化し、効率的で長期的な再帰 AI ワークフローを維持します。

Ahmet-Dedeler/ai-llm-comparison

複数の LLM プロバイダーのリアルタイムな価格と機能の比較を提供する、オープンソースの AI モデル比較ツールです。

z-lab/paroquant

ParoQuantは、学習されたペアワイズ回転を使用して重みの外れ値を低減し、効率的な推論中に高い精度を維持するためのINT4量子化フレームワークです。

Picovoice/picollm

スマートフォンからウェブブラウザまで、さまざまなデバイス上で高精度かつ圧縮されたLLMをローカルで実行できるクロスプラットフォーム推論エンジン。

quantumaikr/quant.cpp

LLM推論用の高性能C言語ライブラリ。KV cache圧縮技術を利用して、コンシューマー向けハードウェアで長文コンテキストのドキュメント理解を可能にし、チャンクベースのRAGを不要にします。

dangeng/visual_anagrams

ピクセルベースの拡散モデルを使用して、回転、反転、または再配置によってアイデンティティが変化する錯覚画像(オプティカル・イリュージョン)を生成するツールです。

automataIA/graphrag-rs

サーバー、WASM、ハイブリッドデプロイに対応し、ドキュメントからナレッジグラフを構築して自然言語クエリを可能にする、高性能 Rust 実装の GraphRAG です。

umbertogriffo/rag-chatbot

llama.cpp と Chroma を使用したローカル RAG チャットボットで、Markdown ベースのナレッジベースをインクリメンタルインデックス化しながら質問に答えます。

hhy-huang/HiRAG

HiRAG は Retrieval‑Augmented Generation フレームワークで、階層的知識を活用して標準的な RAG と比べて LLM の応答品質と包括性を向上させます。

Bessouat40/RAGLight

Retrieval-Augmented Generation (RAG) を実装するための、軽量でモジュール式の Python ライブラリです。ユーザーはさまざまな LLM やベクトルストアを簡単に統合して、ドキュメントとチャットできます。

mkalten/reacTIVision

フィデリティマーカーとマルチタッチ指の追跡を可能にし、実体ユーザーインターフェースの作成を支援するクロスプラットフォームのコンピュータビジョンフレームワークです。

roboflow/roboflow-python

Roboflowの公式Pythonパッケージ。開発者がモデル、データセット、プロジェクトとプログラム的にやり取りし、コンピュータビジョンモデルを自動で構築・デプロイできるようにします。

lessthanoptimal/BoofCV

Javaで書かれたリアルタイムコンピュータビジョンライブラリで、低レベルの画像処理、カメラキャリブレーション、特徴追跡のツールを提供します。

LLPhant/LLPhant

Generative AI とベクトルデータベース用の PHP ライブラリ。LLM とベクトルストアを PHP アプリケーションに統合するための統一インターフェースを提供します。

fudan-generative-vision/Hallo-Live

Hallo-Live は、因果的なデュアルストリーム Diffusion Transformer を使用して、デジタルアバター向けに同期した音声と映像をリアルタイムに生成するテキスト駆動フレームワークです。

open-mmlab/FoleyCrafter

FoleyCrafter は、無音ビデオの映像内容に基づいてリアルで同期した効果音を生成するビデオ‑ツー‑オーディオ フレームワークです。

thu-ml/DiT-Extrapolation

位置エンコーディングの外推によって、より長い動画や高解像度の画像を生成可能にする、Diffusion Transformers 用のプラグアンドプレイ・フレームワーク。

UCSC-VLAA/story-iter

トレーニング不要の反復フレームワークで、最大 100 フレームにわたる長編ストーリーの可視化において、グローバルリファレンスクロスアテンションモジュールを用いて意味的一貫性を保ちます。

Shilin-LU/MACE

MACE は拡散モデル用のファインチューニングフレームワークで、セレブリティや露骨なコンテンツなど、最大 100 個の不要な概念を大量に消去しながら、無関係なモデル知識を保持します。

IntelLabs/RAG-FiT

拡張データセットを作成し、PEFT を用いてモデルをファインチューニングすることで、RAG(Retrieval Augmented Generation)における LLM のパフォーマンスを向上させるライブラリ。

diffgram/diffgram

スキーマ、BLOB、予測結果のための AI データストア。人間による監督とマルチモーダル・データのラベリング・ツールを提供します。

githubharald/SimpleHTR

TensorFlow ベースの手書き文字認識システムで、CNN と LSTM レイヤーを使用して単語やテキスト行の画像をデジタルテキストに変換します。

oxylabs/ai-crawler-py

自然言語プロンプトを使用して、関連ページを発見し、Webサイトから構造化された JSON または Markdown データを抽出する AI 駆動のウェブクローラーです。

microsoft/genaiops-promptflow-template

Prompt flow 用の LLMOps テンプレートで、ローカルでの実験・評価から本番デプロイまで、LLM アプリケーションのエンドツーエンドライフサイクルを効率化します。

zmedelis/bosquet

AI アプリケーション構築のための LLMOps フレームワークで、プロンプトテンプレート、チェーン、エージェントツール統合のツールを提供します。

traceloop/openllmetry-js

JavaScript/TypeScript の LLM アプリケーション向けのオープンソース観測ライブラリで、OpenTelemetry を使用して LLM プロバイダーやベクトルデータベースへの呼び出しをトレースします。

aavetis/PRarena

GitHub上のプルリクエストのマージ率を分析することで、AIコーディングエージェントの成功率を比較するトラッキングシステムおよびダッシュボード。

ray-project/raydp

RayDPはApache SparkをRay上で実行することを可能にし、単一のPythonプログラム内で統一された分散データおよびAIパイプラインの作成を可能にします。