Xiaoqi-Zhao-DLUT/MSNet-M2SNet
MSNetおよびM2SNetアーキテクチャを備えた医療画像セグメンテーションフレームワーク。マルチスケール減算を活用し、ポリープや肺感染症などの病変を正確に分離します。
facebookresearch/tuna-2
Tuna-2は、複雑なビジョンエンコーダやVAEを直接的なピクセル埋め込みに置き換えることで、画像理解と生成の両方を向上させる統合マルチモーダルモデルです。
aimclub/FEDOT
FEDOT は、進化アルゴリズムを使用して機械学習パイプライン(前処理、特徴量エンジニアリング、モデルを含む)を自動的に設計および最適化するオープンソースの Python AutoML フレームワークです。分類、回帰、クラスタリング、時系列予測をサポートし、一般的な ML ライブラリと統合され、シンプルな高レベル API と再現可能なパイプラインエクスポートを提供します。
lucidrains/ema-pytorch
モデルの安定性と性能を向上させるために、訓練中に指数移動平均(EMA)バージョンのモデルを維持するためのPyTorchライブラリ。後処理合成とターゲット表現ルーティングを特徴とする。
SensAI-PT/RAGMeUp
ボイラープレートコードを減らし、プラグアンドプレイアーキテクチャを提供することで、モジュール化・拡張可能なRAGアプリケーションを迅速に構築できるフレームワーク。
princepainter/ComfyUI-PainterI2V
Wan2.2 用の ComfyUI ノードで、画像から動画生成時の遅い動きを改善し、動きの振幅を増加させ、カメラの動きの応答性を高めます。
david8862/keras-YOLOv3-model-set
TensorFlow Kerasベースの包括的なYOLOv2、v3、v4物体検出パイプラインで、多様なバックボーン、高度なトレーニング技術、およびデバイス内でのデプロイをサポートします。
zhangfengcdt/memoir
AIエージェント向けの高性能なセマンティックメモリシステム。Gitに似たバージョン管理、階層的セマンティックパス、暗号的整合性をメモリ管理に導入。
jingkaihe/matchlock
MITMプロキシを介したネットワーク許可リストと安全なシークレットインジェクションにより、隔離された一時的なmicroVMでAIエージェントを実行するためのCLIツールとSDK。
QJHWC/PaperForge
PaperForge Research OS v3は、AI支援による論文執筆、実験オーケストレーション、成果物追跡、および検証可能な出版を統合するPythonベースのツールです。すべての主張と証拠のリンクをSQLite「Scientific Memory」に保存し、3つの実行プロファイル(writing-only、research、full)を強制し、ローカル、Docker、SSH、Slurm、Kubernetes、クラウドコンピューティングのバックエンドをサポートします。CLI (`paperforge …`) とローカルWeb UIを通じて、ユーザーはワークフローの実行、提案の承認、組み込みテンプレート(generic、CVPR、IEEE、Elsevier)を使用したLaTeXのコンパイル、およびシークレットスキャン後の決定論的なソースバンドルのリリースが可能です。再現性のある学術研究のために設計されており、非商用ライセンスの下でオープンソース化されています。
LucasAlegre/morl-baselines
MORL‑Baselinesは、信頼性の高い多目的強化学習アルゴリズム(シングルおよびマルチポリシー、SER/ESR)のPyTorchライブラリです。MO‑Gymnasium APIに準拠し、ユーティリティ、自動W&Bログ、Open RL Benchmarkとの統合により、再現可能な実験を可能にします。
duckbugio/flock
FlockはDockerベースのサービスで、Telegram、VK、またはテキスト専用アダプタを通じてチャットで制御可能なClaude-Code搭載開発チームを提供します。1つのメッセージで計画、コード作成、テスト、レビュー、プルリクエストの開設を実行でき、自己検証、目標評価、スケジュールジョブ、CI監視のオプションループも利用可能。各チャットには独自の隔離されたワークスペースとブランチが割り当てられ、GitHub/GitLab/GiteaとPATで連携。`.env`ファイルを設定した後、`docker compose up -d` で1行でデプロイ可能。コアロジックは `core/agents/` にあり、アダプタは薄いラッパーです。
Gremble-io/Detto
Apple Silicon用のローカルファーストmacOSアプリで、会議、ボイスメモ、システムワイドな音声入力のためのプライベートでオンデバイスの音声認識を提供。構造化されたMarkdownファイルを出力。
echoVic/orca-agent
ターミナルでコードを読み取り、ファイルを編集し、コマンドを実行して開発タスクを自律的に解決できる、DeepSeekに特化したコーディングエージェントです。
epam/ai-dial-chat
AI DIAL Chatは、EPAMのAI DIAL Core LLMサービスに接続する、本物のフルスタックのチャットアプリケーション(Reactフロントエンド + NestJSバックエンド)です。Nx monorepoとして提供され、モジュール式UIライブラリ、マルチプロバイダーOIDC認証、Swagger/OpenAPIドキュメント、および埋め込み可能なiframeオーバーレイが含まれています。リポジトリには、ビルド、テスト、公開のためのスクリプト、およびレガシーバージョンからの移行ガイドが含まれています。
MrBlankness/LightM-UNet
LightM-UNetは、UNetとMambaの軽量な統合であり、わずか1Mのパラメータで高い性能を発揮する医療画像セグメンテーションモデルです。
i207M/PINNacle
偏微分方程式(PDE)を解くための物理情報付きニューラルネットワーク(PINN)の包括的なベンチマークで、複数のバリエーションと挑戦的なデータセットを実装し、性能を評価するものです。
mudrii/openclaw-dashboard
OpenClaw AIエージェントのリアルタイム監視を可能にするゼロ依存のローカルダッシュボード。コスト、システム健全性、エージェント活動をリアルタイムで監視できます。
Palm1r/QodeAssist
QodeAssist は、C++/QML 用の AI 駆動型コード補完、チャット、およびインライン・リファクタリング機能を追加する GPL-v3 の Qt Creator プラグインです。Ollama、llama.cpp、LM Studio などのローカル LLM プロバイダーおよびクラウド LLM プロバイダー (Claude, OpenAI, Gemini, Mistral, Qwen, DeepSeek, etc.) と連携し、そのプロジェクト・コンテキストを認識するツールを Model Context Protocol (MCP) を介して他のエディタで利用可能にします。プロジェクトはアーカイブされており、現在はメンテナンスされていません。
ownpilot/OwnPilot
自律型エージェント、250以上のツール、IoT、ブラウザ自動化、メッセージングアプリとの統合を備えたプライバシー最優先の自己ホスティング型AIアシスタントプラットフォーム。
LarsCowe/bmalph
BMAD-METHODによる計画とRalphによる自律的実装を統合するCLIツール。AI支援プロジェクトを初期分析から自律的TDDコーディングまで移行する。
hustcer/deepseek-review
DeepSeekモデルを使用してGitHub ActionsまたはローカルCLIによるPRレビューを自動化するAI駆動のコードレビューツール。
jumodada/Drissionpage-MCP-Server
ウェブのナビゲーション、インタラクション、データ抽出に向けた、69の正確なブラウザ自動化ツールを提供するAIモデル用のModel Context Protocol (MCP) サーバー。
stardomains3/oxproxion
OpenRouter を通じたクラウドベースの LLM と、Ollama、LM Studio などによるローカルホストモデルを統合して操作できる Android チャットアプリ。
xiaol/wkvm
線形およびハイブリッド線形モデル向けの状態ネイティブ推論ハイパーバイザー。ページ化された KV キャッシュの代わりに、効率的なセッション管理のための固定サイズの状態スロットを使用。
wisent-ai/ster
オープンウェイトLlamaモデルの活性化誘導とLoRAファインチューニングのためのネイティブRust製ツールキット。モデルの動作と特性を制御するために使用されます。
gergap/vim-ollama
OllamaによるローカルLLM実行とプライバシーを活かして、VimにCopilotのようなAIコード補完、チャット、ツールベースの編集機能をもたらすVimプラグイン。
vfarcic/dot-ai
npmで公開されているNode.jsライブラリで、Kubernetes/DevOpsワークフローにLLM駆動のアシスタントを追加します。CLIと管理プラットフォーム (MCP) を提供し、自然言語によるクラスタークエリ、デプロイ推奨事項、自動修復、ポリシー駆動のプロンプト・ライブラリ、およびセマンティック・ドキュメント検索を、Kubernetesクラスターに簡単にインストール可能なパッケージとして提供します。
yeahhe365/Prisma
GeminiおよびOpenAI互換モデル向けの視覚的ディープマルチエージェント推論エンジン。複雑なクエリを並列の専門家タスクに分解し、透明な推論ワークフローを提供。
Simple-Robotics/aligator
Aligatorは、ロボットにおける高速で制約付きの軌道最適化を実現するC++/Pythonライブラリです。モデリングAPI、効率的なソルバー(ProxDDP、FeasibleDDP)、Pinocchio統合、オプションのCrocoddyl互換性、並列CPU最適化を備えています。conda経由またはソースからビルド(CMake/Pixi)でインストール可能。複雑なロボットでの運動計画生成やモデル予測制御の実行にご利用ください。
jayminwest/mulch
MulchはCLI駆動型でGitバックアップされた知識ベースであり、AIエージェントがドメインごとのJSONLファイルに構造化された学び(慣習、失敗、意思決定など)を記録し、後でプロンプトインジェクション用に最適化された抜粋を取得できるようにします。カスタムレコードタイプ、根拠に基づくスコープ、ヘルスチェック、および削除機能をサポートし、チームがエージェントセッション間で専門知識を蓄積・共有できるようにします。
Lamatic/AgentKit
AgentKitは、70の完成済み「キット」(完全なアプリ、パイプライン、またはテンプレート)を提供するオープンソースSDKです。これらのキットはシンプルな設定ファイルで定義され、視覚的なフロースタジオで編集可能で、サーバーレスで動作するNext.jsアプリとして配布されます。サポートトリアージ、コードレビュー、RAGチャット、採用アシスタント、法務・医療ボットなど、多数のビジネス指向のエージェントをカバーしており、信頼性の高いエンタープライズグレードAIエージェントを即時構築できるプラットフォームです。
kyegomez/BitNet
標準的な線形層を二値化された投影に置き換えることで、LLMのメモリと計算要件を劇的に削減する1-bit TransformerのPyTorch実装。
facebookresearch/mmf
MMFは、視覚と言語のマルチモーダル研究のためのモジュール式PyTorchベースのフレームワークであり、最先端モデルのリファレンス実装と分散トレーニング用のツールを提供します。
Core-Mate/OpenGUI
実機上で動作するAndroid用モバイルGUIエージェントフレームワーク。AIエージェントがアプリインターフェースを認識・操作し、長時間にわたる自動化ワークフローを実現。
daanzu/kaldi-active-grammar
Kaldi‑Active‑Grammarは、Kaldi音声認識エンジンのPythonラッパーで、多数の小さな文法をコンパイルし、発話ごとに必要なものだけを有効化できる。主要OS向けのバイナリwheelを同梱、事前学習済み英語モデルを提供、DragonflyおよびCaster音声制御フレームワークのバックエンドを備える。pipでインストール、モデルをダウンロード、ルールを定義し、文脈に応じたコマンド制御を動的に有効化できる。
flashlight/wav2letter
wav2letter++ は、最先端の音声からテキストへのアーキテクチャを実装するためのレシピと学習済みモデルを提供する、エンドツーエンドの自動音声認識フレームワークです。
izwi-ai/izwi
クラウドAPIを必要とせず、音声認識、音声合成、チャットワークフローをローカルで実行できるローカル優先の音声AIプラットフォーム。デスクトップアプリ、CLI、サーバーを提供。
elevenlabs/elevenlabs-js
ElevenLabs の公式 Node.js SDK で、リアルな AI 音声合成、リアルタイム音声ストリーミング、音声駆動 AI エージェントをアプリケーションに統合できます。
jamubc/gemini-mcp-tool
AIアシスタントをGemini/Antigravity CLIに接続するMCPサーバーで、大規模なコードベース分析とサンドボックス化されたコード実行を可能にします。
GetBindu/Bindu
Binduは、任意のLLMベースのエージェントを、セキュアでID検証済み、決済対応のインターネットサービスに変換するオープンソースフレームワークです。組み込みのmTLS、DID署名、Hydra経由のOAuth2、USDC(x402)決済強制、スキル広告、プッシュ通知、ポリグロットSDK(Python、TypeScript、Kotlin)を提供します。`bindufy()` 1回の呼び出しでJSON-RPCエンドポイント、オプションのパブリックトンネル、デプロイヘルパーが得られ、スウォーム、有料API、規制対応B2Bエージェント統合を簡単に構築できます。
OvidijusParsiunas/myvision
コンピュータビジョンの機械学習トレーニングデータを生成するための、自動バウンディングボックス生成とデータセット形式変換をサポートする無料のオンライン画像アノテーションツール。
Seanium/FeedMe
複数のフィードを統合し、LLM を使って自動的に記事要約を生成する AI ベースの RSS リーダー。軽量で静的な読書体験を提供します。
crabwise-ai/crabwalk
Crabwalk は、WhatsApp、Telegram、Discord、Slack 上での OpenClaw AI エージェントの活動を可視化するリアルタイム Web UI です。OpenClaw ゲートウェイから WebSocket でイベントをストリーミングし、ライブのセッションノードグラフを表示し、ツール呼び出しを検査でき、Docker、CLI、ソースインストールでのデプロイをサポートします。
runpod-workers/worker-vllm
RunPod向けのOpenAI互換サーバーレスワーカーで、vLLM推論エンジンを使用した高速なLLMデプロイを可能にします。
veyliss/ai-localbase
OllamaまたはOpenAI互換モデルを使用して、ローカルドキュメントをアップロードし、それらとチャットできるローカル優先のRAGシステムです。
guochengqian/Magic123
2D と 3D の拡散プライアを組み合わせ、粗から細へのパイプラインで単一の 2D 画像から高品質な 3D オブジェクトを生成するシステム。
feyninc/chonkiejs
RAGアプリケーション向けに設計された、軽量で効率的なTypeScriptテキストチャンク分割ライブラリです。セマンティック、再帰的、コード認識型など、複数の分割戦略を提供します。