MAIF/melusine
深層学習と決定論的ルールを統合した包括的なメール処理ライブラリ。メールのルーティング、優先順位付け、セグメンテーションを自動化します。
Snaplii-Inc/agent-to-merchant-payments
事前資金投入とスコープ付きAPIキーを用いて、AIエージェントが安全にギフトカードを購入したり、公共料金を支払ったりできるトークン化された支払い層です。
evelyyyyynnnnn/4.0-Decision-Intelligence-Framework
運用研究とAIを統合した意思決定インテリジェンスフレームワーク。医療や金融など、高リスク分野における堅牢で検証可能な最適化を提供する。
gfo-project/Gradient-Free-Optimizers
混合探索空間のブラックボックス最適化のための Python ライブラリ。ハイパーパラメータチューニングやエンジニアリング設計のために、23種類の勾配フリーアルゴリズムへの統一されたインターフェースを提供します。
EliaAlberti/cpr-compress-preserve-resume
構造化ログとコンテキスト保持を介して、セッション間で永続的なメモリを提供する Claude Code 用のカスタムスキル群。セッション再起動時のトークンコストを削減します。
shift-labs-ai/napkin
AIエージェントがコンテキストウィンドウの制限を管理するために、段階的公開により情報を取得できるローカル優先のファイルベースの知識システム。
half-potato/radiance_meshes
Radiance Meshes 用のトレーニングフレームワーク。画像から 3D シーンのボリューム再構成を可能にし、モバイル Web での閲覧用にモデルを最適化するオプションを備えています。
TornLux/UnrealBridge
AIエージェントがUnreal Engine 5.3+をリアルタイムで制御および編集できるようにするブリッジレイヤー。ハルシネーションを防ぐためのASTベースの検証機能と、Blueprints、VFX、およびリギングとの深い統合を備えています。
EleutherAI/gpt-neox
GPT‑NeoX は、マルチ GPU クラスタ上で数十億パラメータの言語モデルをトレーニングするための、Megatron ベースのオープンソースライブラリです。DeepSpeed スタイルの最適化を追加し、多くのランチャー(Slurm、MPI など)をサポートし、NVIDIA および AMD GPU で動作し、Flash Attention、Mixture‑of‑Experts、選好学習ファインチューニングなどの最新機能を備えています。大規模な計算予算を持つ研究ラボに最適です。推論専用の使用には、Hugging Face `transformers` が推奨されます。
tensorflow/graphics
『合成による解析』を用いて3Dビジョンモデルの自己教師あり学習を可能にする、TensorFlow向けの微分可能なグラフィックスおよび幾何学レイヤーのライブラリ。
a312863063/generators-with-stylegan2
映画、広告、ゲームで使用される、高忠実度でユニークなバーチャルな人間の顔を生成する StyleGAN2 ベースの顔生成器のコレクションです。
netease-youdao/BCEmbedding
RAGのために最適化されたバイリンガルおよびクロスリンガルなエンベディングとリランキングのフレームワークで、中国語と英語間の高性能な検索に特化しています。
tensorly/tensorly
PyTorch、TensorFlow、JAXなどの複数のバックエンドをシームレスにサポートする、テンソル分解とテンソル学習のためのPythonライブラリ。
mbzuai-oryx/Video-ChatGPT
LLMと時空間視覚エンコーダーを組み合わせた動画会話モデルで、動画コンテンツについて詳細で自然な言語での議論を可能にします。
ModelTC/LightX2V-Qwen-Image-Lightning
Qwen‑Image テキストから画像へのモデルの蒸留された、より高速なバージョン(4 または 8 ステップ拡散)で、fp32/bf16/fp8 チェックポイント、LoRA アダプター、すぐに使える ComfyUI ワークフローを提供します。わずかな品質低下で 12〜25 倍の高速化を実現し、Diffusers、ComfyUI、Nunchaku、Cache‑dit と統合できます。
mbzuai-oryx/groundingLMM
GLaMM は、自然言語応答とオブジェクトセグメンテーションマスクを統合し、正確な視覚的グラウンディングを実現するピクセルグラウンディング大規模マルチモーダルモデルです。
EasyJailbreak/EasyJailbreak
EasyJailbreak は、LLM の jailbreak 攻撃をモジュール化したオープンソースの Python フレームワークです。ReNeLLM、GPTFuzz、AutoDAN など、事前に用意されたレシピを提供し、カスタムのセレクター、ミュータター、制約、評価者を組み込んで、ターゲット言語モデルに対する悪意あるプロンプトを生成・実行・スコアリングできます。`pip install easyjailbreak` またはソースからインストールし、`PAIR` レシピなどの高レベル API を使用するか、独自の攻撃パイプラインを構築できます。本プロジェクトにはドキュメント、論文、データセット、実験結果のダウンロードが含まれます。
hako-mikan/sd-webui-supermerger
AUTOMATIC1111のStable Diffusion WebUI用のモデルマージ拡張機能。モデルをメモリ内でマージし、ディスクへの保存なしでブロックごとの重み調整を行うことができます。
ankane/torch.rb
Torch.rbは、PyTorchのC++ライブラリ(LibTorch)をラップするRuby gemであり、Ruby開発者にフル機能のディープラーニングAPIを提供します。テンソル、Autograd、ニューラルネットワーク・モジュール、オプティマイザ、およびGPU(CUDA/MPS)加速をサポートし、PyTorchのPython APIをRubyスタイルのメソッド名でミラーリングしています。インストールには適合するLibTorchビルドが必要ですが、その後はRubyで直接モデル(CNN、GANなど)を構築・実行できます。
mbzuai-oryx/LLaVA-pp
LLaVA++ は、LLaMA-3 と Phi-3 LLM を統合することで、LLaVA 1.5 の視覚的指示に従う能力と学術的タスクのパフォーマンスを向上させます。
voyag-commits/Open-Source-Astra-Alternative
Codex/DeepSeek をバックエンドに持つ一時的ワーカーモデルを用いて、ソフトウェア開発サイクルを自動化する WSL2 アプライアンス。Strata SCTL ライブサイクルハーネスを実行可能。
HasnainRaz/Fast-SRGAN
SR-GANに基づくリアルタイムのスーパーレゾリューション実装で、ピクセルシャッフルを活用して低解像度動画を高解像度に効率的にアップスケールします。
NVlabs/OmniVinci
OmniVinciは、視覚、音声、テキストを統合的に理解するため、専用の時間的・整列(alignment)アーキテクチャを使用し、クロスモーダル推論を向上させるオープンソースの全モーダルLLMです。
levyflux/AViD
AViDは、LoRAとEMAを用いた微調整フレームワークであり、オープンボリュームオブジェクト検出器であるGrounding DINOをカスタムデータセットに効率的に適応可能にします。
lartpang/SAMs-CDConcepts-Eval
画像やビデオを通じて、医療用の病変や工業製品の欠陥などの文脈依存型の概念をセグメント化する SAM と SAM 2 の能力をテストするための包括的な評価フレームワーク。
stepfun-ai/SteptronOss
モジュール式の設定と高速なイテレーションを重視した、大規模言語モデル向けの軽量トレーニングフレームワーク。SFT、RLVR、評価の各段階で活用可能。
FlashLabs-AI-Corp/FlashLabs-Chroma
リアルタイム音声対話用のエンドツーエンドマルチモーダルモデルで、直接音声理解とパーソナライズされた音声クローンをサポートします。
blendi-remade/falcraft
テキストプロンプトから、fal.ai を使って 3D 構造物とゲーム内世界でリアルタイムに AI 動画配信を生成する Minecraft Fabric モッド。
browser-use/browser-harness-js
制限的なヘルパー関数なしで、AI エージェントに Chrome DevTools Protocol のすべてのメソッドへの直接的なアクセスを権限を与える、最小限の型定義された JavaScript ブリッジ。
VinF/deer
DDPG およびダブル Q 学習などのアルゴリズムの実装を提供するモジュール式の Python ライブラリ。
lucidrains/autoregressive-diffusion-pytorch
拡散モデルを用いることでベクトル量子化を必要としない、自己回帰的な画像生成のPyTorch実装です。
Leavesfly/TinyAI
Javaのみで構築されたフルスタックAIフレームワーク。低レベルのテンソル計算からLLM、AIエージェント、および具身知能(Embodied Intelligence)への完全なパイプラインを提供します。
HITSZ-NRSL/Dynamic-VINS
動的環境において、移動物体を除外することで、リソース制限されたロボットが正確な位置推定を維持できるように設計されたリアルタイムRGB-D慣性オドメトリシステムです。
wb04307201/spring-ai-loom-agent
RAG、MCPツール統合、スキルマーケット、およびエンタープライズグレードのAgentデプロイ用の管理コンソールを備えた、完全なAIエージェントフレームワークを提供するSpring Boot starterです。
InditexTech/mcp-server-simulator-ios-idb
自然言語コマンドを使用して、LLM が iOS シミュレータを制御し、アプリ管理や UI テストを行うことを可能にする MCP サーバーです。
roboserg/RoboLeague
車両制御、ホバリング、および空中でのボールハンドリングを強化学習エージェントに学習させるための Unity ML-Agents 実験のコレクションです。
Luo-Yihao/FaithC
SDFとMarching Cubesを置き換える、鋭いエッジと内部構造を保持する近似損失なしの3Dボクセル表現システム。Faithful Contour Tokens (FCTs) を用いて実現。
jolibrain/colette
Coletteは、PDFを画像としてインデックス化し、表、図、レイアウトを保持する自己ホスト型RAGプラットフォームです。ビジョン埋め込み、BM25語彙検索、オプションのHyDEプロンプティングを組み合わせ、Docker経由で高スペックGPU上で動作します。機密性の高い技術文書に最適です。
google-ar/arcore-ios-sdk
GoogleのクロスプラットフォームARCore機能(Cloud AnchorsやGeospatial APIなど)をiOSアプリケーションに導入するソフトウェア開発キットです。
arthurflor23/handwritten-text-recognition
TensorFlowベースのフレームワークで、広範なデータ増強と複数の標準HTRデータセットをサポートする手書きテキスト認識および合成技術を提供。
TetreesEX/TetreesAgent_EX
Tetrees Agent EX は、公開 MCP コントラクトを介して Tetrees EX マーケットプレイス上の AI パックを検索、見積もり、実行、拡張、公開できる Node.js SDK/CLI です。購入者、構築者、販売者のフロー用の例題スクリプトを提供し、すべての資格情報をローカルに保持します。
nahrek/polyledger
Polymarketの市場メタデータとオンチェーン取引データをクエリ可能なDuckDBデータベースに集約する、再開可能なインデクサー。
alexandre01/deepsvg
深層学習と微分可能なテンソルを用いて、ベクターグラフィックス(SVG)の生成とアニメーションを行う階層的生成ネットワークおよびライブラリ。
caiyuanhao1998/Open-OmniVCus
OmniVCusは、深度やマスクなどのマルチモーダル制御条件の下で、特定の被写体を含む動画を生成するフィードフォワード型被写体中心の動画カスタマイズフレームワークであり、拡散Transformerを用いて実現されています。
qdrant/quaterion
セマンティック検索、推薦、異常検出に特化した事前学習モデルを、高速にファインチューニングできるフレームワーク。
candle-org/MindAct
PyTorchおよびHugging Faceネイティブのツールキットで、ロボットによるデスクトップ操作の模倣学習ポリシーを再現可能な形でトレーニングおよび評価します。
openMVG/openMVG
画像(写真測量)からの3D再構成のためのC++フレームワークで、構造から運動問題を解決するためのライブラリとパイプラインを提供します。
JavisVerse/JavisDiT
テキストプロンプトから音声と映像の意味的・時間的整合を保証する、音声付き動画生成のための統合型 Diffusion Transformer フレームワーク。