OpenEnvision/WorldFoundry
動画生成、3D/4D表現、および身体的AIにおいて、推論、アセットステージング、ベンチマーク評価を統合的に提供するオープンソースのインフラストラクチャ。
devswha/patina
4言語で動作する決定論的でパターンベースのヒューマナイザー。AIらしい表現を自然な言語に書き換える一方で、事実の意味を厳密に保持する。
ai-shifu/ChatALL
ユーザーが複数のAIボットに同時にプロンプトを送信して、回答を比較し、最適な結果を見つけることができるデスクトップクライアント。
shinpr/claude-code-workflows
Claude Code Development Workflows は、Claude AIアシスタントを構造化された開発パイプラインに変える、Claude Codeプラグインのセットです。プラグインは「レシピ」(例:`/recipe‑implement`、`/recipe‑design`、`/recipe‑review`)を提供し、成果の合意、設計文書化、作業計画生成、タスクレベルの実装と自動検証、独立したセキュリティレビューを強制します。バックエンド、Reactフロントエンド、フルスタックプロジェクトに対応する3つのプラグインファミリーがあり、Claudeのマーケットプレイスからインストール可能です。繰り返し可能なセーフティゲートと設計からコード生成への正式な引き渡しが必要な場合に有用です。素早いプロトタイプ作成の場合はスキップ可能です。
NVlabs/physical_ai_av
NVIDIA Physical AI Autonomous Vehicles Dataset にアクセスして、エンドツーエンドの走行システムを構築するための Python 開発者キット。
NVlabs/alpamayo
Alpamayo 1 は、複雑で稀な運転シナリオに対応するため、推論トレースと軌道予測を組み合わせたビジョン・ランゲージ・アクションモデルです。
ultralytics/yolo-flutter-app
iOSおよびAndroidでリアルタイムのYOLOモデル推論(オブジェクト検出、セグメンテーション、ポーズ推定)を可能にする公式Ultralyticsプラグイン。
AltimateAI/altimate-code
主要なクラウドプラットフォーム間でSQL分析、カラムレベルのラインエージェンス、およびワーケーハウス接続を実現する決定論的なツールをLLMに提供するオープンソースのデータエンジニアリングハーネスです。
Ikalus1988/MisakaNet
AIエージェントが既知のデバッグエラーを繰り返さないよう、検証済みの回復レッスンを検索・再利用できるGitベースの失敗記憶システムです。
AmberSahdev/Open-Interface
LLM を使用し、視覚フィードバックに基づいてキーボードとマウス入力をシミュレートし、PC を自律的に操作する AI 駆動のコンピュータ自動化ツールです。
IBM/mcp
AIエージェントがIBM製品およびエンタープライズリソースと安全にやり取りできるようにするModel Context Protocol (MCP) サーバーとツールのコレクションです。
paperclipinc/openclaw-operator
宣言的APIを通じて、プロダクションレベルのセキュリティ、観測性、および自動化されたライフサイクル管理を提供する、OpenClaw AIエージェントの自己ホスティング用Kubernetesオペレーターです。
sachinhosmani/torchvista
ノートブック内で直接前方伝播をトレースし可視化できる、PyTorch モデル用のインタラクティブな可視化ツールです。
ekimetrics/adaptive-chunking
5つの内在的な品質指標を評価することで、各ドキュメントに対して最適なチャンク分割戦略を自動的に選択するRAGパイプライン用のフレームワークです。
mit-han-lab/torchquantum
PyTorch ベースのフレームワークで、古典ハードウェア上で量子計算をシミュレートし、パラメトリック量子回路やハイブリッド古典‑量子モデルのトレーニングを可能にします。
mlmed/torchxrayvision
胸部X線データセットとモデルのためのライブラリで、事前学習済みモデルと統一インターフェースを提供し、複数の公開胸部X線データセットでの作業を容易にします。
netket/netket
NetKet は、ニューラルネットワークと機械学習を使用して多体系量子系を研究するための、JAX ベースの Python ライブラリです。
weiwill88/Local_Pdf_Chat_RAG
学習と実験のために設計された、ハイブリッド検索と複数のLLMバックエンドをサポートする、モジュール式のRAGパイプラインのPython実装。
automagik-dev/genie
AIコーディングエージェント向けの計画・実行レイヤーで、高レベルなリクエストを構造化された計画と並列化されたPRに変換する、厳格な設計・レビューワークフローを実現します。
winstonkoh87/Athena-Public
任意のLLMに対してポータブルでユーザー所有の記憶とガバナンス層を提供する、ローカルファーストのエージェント型個人知識管理システムです。
expectedparrot/edsl
計算社会科学と市場調査向けのドメイン固有言語で、AI エージェントと LLM を用いたアンケートや実験の設計・実行を可能にします。
iMoonLab/Hyper-RAG
ハイパーグラフ駆動の Retrieval-Augmented Generation(RAG)フレームワークで、ドメイン固有の知識における複雑でペアを超える関係性を捉えることで、LLM の幻覚(ハルシネーション)を低減します。
PhotonVision/photonvision
FIRST Robotics Competitionのロボット向けにカスタマイズされた、無料かつ高速なコンピュータビジョンソリューション。容易な統合と画像処理のためのツールを提供します。
NVIDIA/raft
機械学習とデータマイニング向けの CUDA 加速基礎アルゴリズムとプリミティブのライブラリで、高性能 AI アプリケーションの構成要素として設計されています。
jia-gao/leanctx
ロス許容ルーティングを使用して、重要なコードやツールコールを保護しながら、プロースを圧縮することで、LLM 入力トークンコストを 10–40% 削減するドロップイン型プロンプト圧縮ライブラリ。
stevesolun/ctx
実際のタスクに応じて候補となる設定をテストし、最も安価で信頼性の高いAIコーディング設定をリポジトリに適用するツール。
helblazer811/Diffusion-Explorer
拡散モデルとフローベース生成モデルの背後にある幾何学的な直感的な理解を助ける、教育目的のインタラクティブな可視化ツールです。
cuevhv/mamma
MAMMA はマーカーレスのマルチパーソン 3D 動作取得システムで、マルチビュー映像から正確な人体ポーズを再構築します。
alexandremendoncaalvaro/CorridorKey-Runtime
DaVinci Resolve と Foundry Nuke 用のネイティブ AI キーイングランタイムと OFX プラグインで、ビデオエディター向けに自動化された機械学習加速の背景除去を提供します。
dog-qiuqiu/FastestDet
ARM CPU と組み込みデバイス向けに高速推論を最適化した、超軽量でアンカーフリーなリアルタイム物体検出アルゴリズム。
pixeltable/pixeltable
AIデータアプリ用の統合マルチモーダルバックエンドで、データベース、オーケストレーション、サービング層を1つのPythonファイルに統合しています。
bytedance/Sa2VA
Sa2VAは、SAM‑2セグメンテーションとマルチモーダルLLM (InternVL, Qwen‑VL) を融合させ、画像や動画のピクセルレベルのグラウンデッドな理解を提供するための、ByteDanceの研究用コードベースです。コアとなるSa2VAモデル、VRT推論ベンチマーク、SAMTokマスク・トークン・インターフェース、および SaSaSa2VA のような拡張機能が含まれています。リポジトリは再現可能な環境構築のために `uv` パッケージマネージャーを使用し、セットアップスクリプトを提供し、論文、モデル・ズー、モデル・データセットへのリンクを提供しています。
ARM-software/ComputeLibrary
Arm Cortex-A、Neoverse、Mali GPU アーキテクチャ向けに最適化された低レベル機械学習関数のコレクションで、高性能な ML 推論を提供します。
Tencent-Hunyuan/HunyuanVideo-1.5
軽量な 8.3 億パラメータの動画生成モデルで、コンシューマー向け GPU 上で高品質なテキストから動画、画像から動画の合成を実現します。
EdoardoBotta/RQ-VAE-Recommender
アイテムを意味IDにマッピングするRQ-VAEと、次のアイテムを予測するTransformerを用いた、生成型推薦のためのPyTorchフレームワーク。
zakirkun/guardian-cli
AI を活用したペネトレーションテスト自動化フレームワークで、セキュリティツールとマルチエージェント AI をオーケストレーションし、適応的なセキュリティ評価と証拠に基づくレポートを実現します。
shcherbak-ai/contextgem
ドキュメントから構造化データと洞察を抽出し、正確なソース参照と自動的な根拠付けを行うためのオープンソースの LLM フレームワークです。
gudaochangsheng/RefAlign
推論時にオーバーヘッドを追加せずに、アイデンティティの一貫性と参照の忠実度を向上させる、参照から動画生成のためのトレーニング時アライメントフレームワーク。
simchowitzlabpublic/nano-world-model
拡散強制に基づく動画ワールドモデルの学習に向けたミニマルなフレームワーク。将来の動画予測、3D再構成、ロボット計画に利用可能。
shivammehta25/Matcha-TTS
Matcha-TTS は高速で非自己回帰型のテキスト音声合成アーキテクチャで、条件付きフローマッチングを使用して高品質かつ効率的な音声合成を実現します。
AI-Hypercomputer/maxtext
Google Cloud TPUsおよびGPU上で大規模モデルの事前学習および事後学習を行うための、JAXおよびPythonで記述された高パフォーマンスでスケーラブルなLLMライブラリ。
huggingface/optimum-intel
Hugging Face ライブラリと OpenVINO の間のインターフェースであり、Intel アーキテクチャ上での AI モデルの推論と最適化を加速させます。
emlearn/emlearn
トレーニング済みの scikit-learn と Keras モデルをポータブルな C99 コードに変換し、マイクロコントローラや組み込みシステムで効率的に推論できるツール。
cyrusbehr/tensorrt-cpp-api
NVIDIA TensorRT を使用した CNN モデルの高性能 GPU 推論のためのモダン C++ ライブラリ。安全なエンジンキャッシュとゼロコピー Python バインディングを備えています。
huggingface/huggingface.js
(@huggingface/hub、@huggingface/inference、@huggingface/mcp-clientなど)現代的でTypeScript型付きのJavaScriptパッケージのコレクション。ブラウザ、Node、Deno、Bunから、リポジトリの作成、ファイルのアップロード、Hugging Face推論API(チャット、テキストから画像生成、翻訳、ストリーミング、カスタムエンドポイント)の呼び出しが可能。
openvinotoolkit/open_model_zoo
高性能な推論アプリケーションの開発とデプロイを加速するための、最適化された学習済みディープラーニングモデルとツールのコレクションです。
openvinotoolkit/model_server
OpenVINO Model Server (OVMS) は、OpenAI互換のRESTまたはKServe gRPC APIを介してLLM、ビジョン・ランゲージモデル、および古典的なディープラーニングモデルを提供するC++推論サーバーです。Intel CPU、GPU、NPUに最適化されており、継続的バッチ処理、ストリーミング、モデルバージョニング、ホットリロード、Prometheusメトリクスなどの機能を提供します。Docker、バーマルバイナリ、Kubernetes経由でデプロイ可能で、TensorFlow、ONNX、OpenVINO IR、GGUFなど多くのモデルフォーマットをサポートし、標準的なクライアントライブラリと統合可能です。
aeon-toolkit/aeon
分類、予測、クラスタリングのための最先端アルゴリズムを提供する、scikit-learn互換のPythonライブラリ。