AlekPet/ComfyUI_Custom_Nodes_AlekPet
ComfyUI用のカスタムノードのコレクションで、プロンプト翻訳、AI駆動コンテンツ生成、画像操作ツールを追加します。
TalAter/annyang
音声認識を使用して、音声コマンドでウェブサイトを操作できるようにする軽量なJavaScriptライブラリ。
MatteoFasulo/Whisper-TikTok
OpenAI-WhisperとEdge TTSを使用して、自然なナレーション付きの字幕入りTikTok動画を自動生成するAIツール。
lenML/Speech-AI-Forge
ChatTTS、CosyVoice、Whisperを含む複数のTTSおよびASRモデルに対して、一元化されたインターフェースを提供する統合フレームワークおよびAPIサーバー。
duoan/mega-data-factory
Web規模のマルチモーダルデータセットを処理するための、Rust加速オペレーターを備えた分散型・高スループットパイプライン。
UfoMiao/zcf
ZCFは、Claude CodeとCodexのワンクリック初期化を提供するゼロコンフィグ・セットアップツールであり、ワークフロー、API、およびエージェントシステムの構成を自動化します。
EvolvingAgentsLabs/evolving-agents
パフォーマンスの低下を防ぐために、コード、目的、トレースをバージョン管理できる、Claude Agent SDK プラグインとしてのバージョン管理システムとAIエージェント用SDK
mratsim/Arraymancer
Nim 用の高性能 n 次元テンソルライブラリで、CPU、CUDA、OpenCL バックエンド上での科学計算、機械学習、深層学習のためのツールを提供します。
SerialLain3170/AwesomeAnimeResearch
アニメおよびカートゥーン生成に焦点を当てた、画像合成からアニメーション制作までを網羅する研究論文とデータセットの厳選されたコレクション。
asyml/texar
Texar は NLP とテキスト生成のためのモジュール式ツールキットで、使いやすい機械学習モジュールと事前学習済みモデルを提供し、迅速なプロトタイピングと実験を可能にします。
Orkas-AI/Orkas-VideoStudio
読みやすく編集可能なプランファイルを通じて、AIコーディングエージェントが動画の構成、編集、生成を行うことを可能にするツールキット。自動動画制作の決定論的パイプラインを提供します。
FullAgent/fulling
Fulling は、ランタイム、メモリ、スキルを安全な Kubernetes ベースの認証境界内に統合した、専用 AI ワークスペース構築のための基盤です。
crabtalk/crabtalk
AIエージェントを実行し、ツールをディスパッチし、MCPサーバーに接続するエージェントデーモン。安全なツール実行のために制限されたharnessesを使用します。
opea-project/GenAIExamples
多様なハードウェアプラットフォーム上で GenAI アプリケーションの拡張とテストを簡素化するために設計された、マイクロサービスベースの生成 AI の例とデプロイガイドのコレクションです。
google-deepmind/dm_pix
PIXは、JAXベースの画像処理ライブラリであり、GPU/TPU加速機能(例:反転、リサイズ)を提供します。`jax.jit`でコンパイル、`jax.vmap`でベクトル化、または`jax.pmap`で複数デバイス上で実行可能です。まずJAXをインストールし、次に`pip install dm-pix`を実行してください。NumPyの画像処理コードと同様に利用可能ですが、JAXのフルパフォーマンスと自動微分機能を利用できます。
flytohub/flyto-core
AIエージェント向けのPython実行エンジンで、ワークフローのすべてのステップを記録し、失敗したステップから再実行・再開できるようにすることで、全体のプロセスを再起動する必要をなくします。
hysts/anime-face-detector
PyTorch ベースのツールで、事前学習済み Faster R-CNN、YOLOv3、HRNetV2 モデルを使用してアニメ顔を検出し、28 個の顔ランドマークポイントを推定します。
RaoFoundation/bittensor
機械知能およびその他のデジタル商品に対して競争的な市場を創出するための、ブロックチェーンベースのインセンティブシステムによって報酬が与えられる分散型プラットフォームおよび SDK です。
callstackincubator/cali
React Native と Expo チーム向けのロール指向 CLI で、AI エージェントを使ってモバイル QA、パフォーマンスレビュー、実装を自動化します。
openonion/connectonion
プロダクション対応のAIエージェントを構築・デプロイするためのテンプレート優先のフレームワーク。組み込みツール、チャットインターフェース、高度なデバッグ機能を提供します。
agentic-in/inferoa
ループエンジニアリング向けに設計された、推論ネイティブなエージェント。トークン使用とキャッシュ再利用を最適化し、効率的で長期的な再帰 AI ワークフローを維持します。
Ahmet-Dedeler/ai-llm-comparison
複数の LLM プロバイダーのリアルタイムな価格と機能の比較を提供する、オープンソースの AI モデル比較ツールです。
z-lab/paroquant
ParoQuantは、学習されたペアワイズ回転を使用して重みの外れ値を低減し、効率的な推論中に高い精度を維持するためのINT4量子化フレームワークです。
Picovoice/picollm
スマートフォンからウェブブラウザまで、さまざまなデバイス上で高精度かつ圧縮されたLLMをローカルで実行できるクロスプラットフォーム推論エンジン。
quantumaikr/quant.cpp
LLM推論用の高性能C言語ライブラリ。KV cache圧縮技術を利用して、コンシューマー向けハードウェアで長文コンテキストのドキュメント理解を可能にし、チャンクベースのRAGを不要にします。
dangeng/visual_anagrams
ピクセルベースの拡散モデルを使用して、回転、反転、または再配置によってアイデンティティが変化する錯覚画像(オプティカル・イリュージョン)を生成するツールです。
automataIA/graphrag-rs
サーバー、WASM、ハイブリッドデプロイに対応し、ドキュメントからナレッジグラフを構築して自然言語クエリを可能にする、高性能 Rust 実装の GraphRAG です。
umbertogriffo/rag-chatbot
llama.cpp と Chroma を使用したローカル RAG チャットボットで、Markdown ベースのナレッジベースをインクリメンタルインデックス化しながら質問に答えます。
hhy-huang/HiRAG
HiRAG は Retrieval‑Augmented Generation フレームワークで、階層的知識を活用して標準的な RAG と比べて LLM の応答品質と包括性を向上させます。
Bessouat40/RAGLight
Retrieval-Augmented Generation (RAG) を実装するための、軽量でモジュール式の Python ライブラリです。ユーザーはさまざまな LLM やベクトルストアを簡単に統合して、ドキュメントとチャットできます。
mkalten/reacTIVision
フィデリティマーカーとマルチタッチ指の追跡を可能にし、実体ユーザーインターフェースの作成を支援するクロスプラットフォームのコンピュータビジョンフレームワークです。
roboflow/roboflow-python
Roboflowの公式Pythonパッケージ。開発者がモデル、データセット、プロジェクトとプログラム的にやり取りし、コンピュータビジョンモデルを自動で構築・デプロイできるようにします。
lessthanoptimal/BoofCV
Javaで書かれたリアルタイムコンピュータビジョンライブラリで、低レベルの画像処理、カメラキャリブレーション、特徴追跡のツールを提供します。
LLPhant/LLPhant
Generative AI とベクトルデータベース用の PHP ライブラリ。LLM とベクトルストアを PHP アプリケーションに統合するための統一インターフェースを提供します。
fudan-generative-vision/Hallo-Live
Hallo-Live は、因果的なデュアルストリーム Diffusion Transformer を使用して、デジタルアバター向けに同期した音声と映像をリアルタイムに生成するテキスト駆動フレームワークです。
open-mmlab/FoleyCrafter
FoleyCrafter は、無音ビデオの映像内容に基づいてリアルで同期した効果音を生成するビデオ‑ツー‑オーディオ フレームワークです。
thu-ml/DiT-Extrapolation
位置エンコーディングの外推によって、より長い動画や高解像度の画像を生成可能にする、Diffusion Transformers 用のプラグアンドプレイ・フレームワーク。
UCSC-VLAA/story-iter
トレーニング不要の反復フレームワークで、最大 100 フレームにわたる長編ストーリーの可視化において、グローバルリファレンスクロスアテンションモジュールを用いて意味的一貫性を保ちます。
Shilin-LU/MACE
MACE は拡散モデル用のファインチューニングフレームワークで、セレブリティや露骨なコンテンツなど、最大 100 個の不要な概念を大量に消去しながら、無関係なモデル知識を保持します。
IntelLabs/RAG-FiT
拡張データセットを作成し、PEFT を用いてモデルをファインチューニングすることで、RAG(Retrieval Augmented Generation)における LLM のパフォーマンスを向上させるライブラリ。
diffgram/diffgram
スキーマ、BLOB、予測結果のための AI データストア。人間による監督とマルチモーダル・データのラベリング・ツールを提供します。
githubharald/SimpleHTR
TensorFlow ベースの手書き文字認識システムで、CNN と LSTM レイヤーを使用して単語やテキスト行の画像をデジタルテキストに変換します。
oxylabs/ai-crawler-py
自然言語プロンプトを使用して、関連ページを発見し、Webサイトから構造化された JSON または Markdown データを抽出する AI 駆動のウェブクローラーです。
microsoft/genaiops-promptflow-template
Prompt flow 用の LLMOps テンプレートで、ローカルでの実験・評価から本番デプロイまで、LLM アプリケーションのエンドツーエンドライフサイクルを効率化します。
zmedelis/bosquet
AI アプリケーション構築のための LLMOps フレームワークで、プロンプトテンプレート、チェーン、エージェントツール統合のツールを提供します。
traceloop/openllmetry-js
JavaScript/TypeScript の LLM アプリケーション向けのオープンソース観測ライブラリで、OpenTelemetry を使用して LLM プロバイダーやベクトルデータベースへの呼び出しをトレースします。
aavetis/PRarena
GitHub上のプルリクエストのマージ率を分析することで、AIコーディングエージェントの成功率を比較するトラッキングシステムおよびダッシュボード。
ray-project/raydp
RayDPはApache SparkをRay上で実行することを可能にし、単一のPythonプログラム内で統一された分散データおよびAIパイプラインの作成を可能にします。