torch-points3d/torch-points3d

3D分類、セグメンテーション、検出のための最先端モデルと高レベルAPIを提供する、点群分析向けの深層学習フレームワーク。

gemelo-ai/vocos

スペクトル係数と逆フーリエ変換を使用して、音響特徴から高品質な音声波形を合成する高速なニューラルボコーダー。

data-prep-kit/data-prep-kit

LLMの事前学習、ファインチューニング、RAGアプリケーション向けに、非構造化データをクリーニング、変換、拡張するためのスケーラブルなツールキット。

senstella/parakeet-mlx

Apple Silicon向けにNvidiaのParakeet ASRモデルをMLXベースで実装したもので、ストリーミングとタイムスタンプのサポートを備えた効率的なローカル音声文字起こしを提供します。

zamalali/DeepGit

キーワードやスター数だけでなく、意図とソースコード分析に基づいて最適なリポジトリを見つけるために、LLMとセマンティックリコールを使用するGitHub向けエージェント型リサーチエンジン。

runesleo/x-reader

YouTube、X、WeChatなど、さまざまなプラットフォームからコンテンツを取得・音声認識・要約し、構造化された形式に変換するユニバーサルコンテンツリーダー。

norlab-ulaval/libpointmatcher

ロボット工学およびコンピュータビジョンにおける3D点群の整列に使用する、Pythonバインディング付きのモジュール式C++ライブラリ。

owensgroup/RXMesh

GPU加速された三角メッシュ処理ライブラリで、幾何処理タスク用に統合された行列インフラストラクチャと自動微分を備えています。

cubezhao/ai-tools-mng

AIアカウント、サブスクリプション、メールを管理するクロスプラットフォームのデスクトップマネージャーで、ワンクリックでのアカウント切り替えとサブスクリプション追跡を提供します。

NaturalIntelligence/imglab

COCO や Pascal VOC などのフォーマットをサポートする、オブジェクト検出器のトレーニングデータ作成用のウェブベースの画像ラベリングツール。

AI-Anywhere/AI-Anywhere

デスクトップまたはモバイルの任意のブラウザから、tmuxベースのAIエージェントCLIセッションにアクセス・管理するためのウェブインターフェースと管理レイヤーです。

PoseLib/PoseLib

カメラ姿勢推定のための最小ソルバーとロバスト推定器のコレクション。多様な対応関係とカメラモデルをサポートし、依存関係を最小限に抑えています。

bcmi/libcom

現実的なオブジェクト挿入を可能にする統一されたツールセットを提供する画像合成ツールボックス。調和、影生成、配置評価を含む。

PozzettiAndrea/ComfyUI-SAM3

MetaのSAM3用のComfyUI統合で、自然言語のテキストプロンプトを使用してオープンボキャブラリ画像および動画セグメンテーションを実現します。

Laxcorp-Research/project-raven

ローカルストレージとBYOK APIキーを使用して、ステルスオーバーレイによるリアルタイムAI支援と、会議終了後の自動要約を提供するオープンソースのミーティングコ・ピロット。

qibin0506/Cortex

ゼロから軽量な0.1B MoE大規模言語モデルを構築するためのフルライフサイクルトレーニングパイプラインを提供するオープンソースプロジェクト。事前学習、SFT、RLHFを含む。

tin2tin/Pallaidium

Blender Video Editorに統合された生成AI映画スタジオで、AI生成された動画、音声、テキストを使って、フルフィルム制作をプロトタイピングできる。

reczoo/FuxiCTR

FuxiCTRは、クリックスルー率予測のためのオープンソースPythonライブラリ(PyPIパッケージ)です。PyTorchおよびTensorFlow用に実装された40以上の現代的なCTRモデル(古典的な因子分解機型と最近のシーケンス対応アーキテクチャ)をバンドルしています。設定の柔軟性、自動ハイパーパラメータチューニング、再現可能なベンチマーク、拡張のしやすさを重視しており、広告、レコメンデーション、スポンサード検索システムの研究者やエンジニアにとって有用です。

Azure-Samples/openai

Azure AI Foundry と Azure OpenAI Service を使用してエージェントワークフローおよびAIソリューションを構築するための実用的なコードサンプルとテンプレートのコレクション。

lonr-6/cc-desktop-switch

Claude Desktop ユーザーがローカルゲートウェイを介して、サードパーティの Anthropic互換 API プロバイダーを管理・切り替えできる軽量デスクトップアプリケーション。

alinaqi/maggy

Claude Codeにマルチモデルルーティング、TDDの強制、隔離された並列エージェント実行を追加するエンジニアリングハーネス。自己レビュー型開発システムを構築する。

ThinkInAIXYZ/go-mcp

外部システムとAIアプリケーション間のシームレスな通信を可能にする、Model Context Protocol (MCP) のGo実装SDKです。

vercel-labs/bash-tool

AIエージェントがサンドボックス環境内でシェルコマンドを実行し、ファイルを管理できる汎用的なバッシュツールです。

MaestroError/LarAgent

Laravel用のAIエージェント開発フレームワークで、Eloquent風APIとLaravelスタイルのツールを用いてAIエージェントの作成と保守を可能にします。

microsoft/multilspy

AI駆動のコード生成やエージェントをサポートするため、複数の言語サーバーから静的解析結果を照会するための統一 API を提供する Python LSP クライアントライブラリ。

MIV-XJTU/JanusVLN

JanusVLNは、エムベデッドエージェントのための視覚言語ナビゲーションフレームワークであり、意味理解と3D空間認知を分離し、相互に補完する二重暗黙的記憶システムを用いて、両者の統合を実現します。

Kaixhin/imitation-learning

SACをベースに、GAILやREDなどのディープインミテーションラーニングアルゴリズムを統合的にベンチマーク・実装するフレームワーク。Gym MuJoCo環境で検証済み。

Sharrnah/whispering

ストリーミングオーバーレイやゲーム内利用向けに設計された、リアルタイム音声認識・翻訳およびOCRを実行するローカルでオープンソースのツール。

dseditor/QwenASRMiniTool

Qwen3-ASRとWhisperモデルを基にしたローカルオフライン音声認識字幕生成ツール。音声・動画・マイク録音をSRT字幕に変換可能。CPUまたはGPU加速に対応。複数の特化言語モデル、話者分離、カラオケ文字単位ハイライトを内蔵。コマンドラインインターフェースとOpenAI互換APIを提供。

anaisbetts/mcp-youtube

yt-dlpを用いてYouTube字幕をダウンロード・読み取り、AIアシスタントが動画の要約や分析を行うことを可能にするModel Context Protocolサーバー。

papercomputeco/stereOS

AIエージェントを安全に実行するために特別に設計された、強化され最小限のLinuxオペレーティングシステム。専用のオーケストレーションデーモンと再現可能なイメージビルドを備えています。

UCSC-VLAA/OpenVision

マルチモーダル学習向けのオープンソースでコスト効率の良いビジョンエンコーダーのファミリー。理解と生成のタスクにおいて、トレーニング効率と性能を最適化しています。

Seeed-Studio/OSHW-reCamera-Series

エッジAI向けに統合NPUを備えたAI駆動ビジョンモジュール「reCameraシリーズ」のハードウェアドキュメントおよび設計リソースハブ。

BeamNG/BeamNGpy

BeamNG.tech 用の Python API で、車両シミュレーションのリモート制御、センサデータの収集、AI駆動の車両挙動を研究およびロボティクスに活用できます。

atopos31/llmio

複数の AI プロバイダー向けに統合 REST API、重み付きスケジューリング、詳細な監視機能を提供する Go ベースの LLM ロードバランシングゲートウェイ。

JayantDevkar/claude-code-karma

ローカルの JSONL ファイルから Claude Code セッションデータを読み取り、コスト、トークン使用量、ツール活動に関する分析を提供するローカル優先ダッシュボード。

papercomputeco/tapes

コンテンツアドレス指定されたLLM相互作用のための耐久性のあるストレージとOpenTelemetryインストルメンテーションを提供するエージェントテレメトリシステム。

jtydhr88/ComfyUI-HY-Motion1

HY-Motion 1.0に基づくテキストから3D人間の動きを生成するComfyUIプラグイン。プロンプト最適化とGLB・FBXへのエクスポートを備える。

CellProfiler/CellProfiler

CellProfilerは、プログラミングやコンピュータビジョンの専門知識がなくても、数千枚の画像から自動的かつ定量的に表現型を測定できるオープンソースのソフトウェアです。

rburkholder/trade-frame

オプション・コンボの追跡、リアルタイムのギリシャ値の計算、および複数ブローカー間での取引執行のための専門ツールを提供する、高容量・低レイテンシ取引向けの C++ フレームワーク。

chenxiachan/xhs-claude-skills

Claude Codeプラグインで、Xiaohongshu投稿を構造化されたObsidianノートに変換し、画像OCRと動画音声認識をサポート。

inulute/simplexity-ai-app

コミュニティが構築した P AI のネイティブデスクトップラッパーで、グローバルショートカットやトレイ統合といったネイティブシステム機能を追加し、より迅速なAI検索アクセスを実現。

Dao-AILab/causal-conv1d

PyTorch用の高パフォーマンスCUDA実装で、複数の精度とカーネルサイズをサポートする因果的深さ方向1D畳み込み。

chenpipi0807/ComfyUI-Index-TTS

高品質な音声クローンとテキスト to スピーチを実現するComfyUI拡張。多言語対応、感情制御、複数キャラクターの小説構文解析を備える。

TechyNilesh/DeepImageSearch

マルチモーダル埋め込みとベクトルインデックスを使用したテキスト、画像、ハイブリッド検索をサポートする、AI駆動の画像検索システムを構築するための Python ライブラリ。

ray-project/llm-applications

Rayフレームワークを使用して、RAGベースのLLMアプリケーションの構築、スケーリング、本番化を実現する包括的なガイドと実装

NousResearch/Hermes-Bot-Mode

Hermes Agent用のデスクトップ・プラグイン。エージェント・プロファイルを、個別の性格、グループチャット機能、および自動化されたルーチンを備えた、名前付きボットのリストへと変換します。

crate/crate

リアルタイムの大規模データセット分析に適した、NoSQLのスケーラビリティと標準SQLの強力さを統合した分散型SQLデータベース。