torch-points3d/torch-points3d
3D分類、セグメンテーション、検出のための最先端モデルと高レベルAPIを提供する、点群分析向けの深層学習フレームワーク。
gemelo-ai/vocos
スペクトル係数と逆フーリエ変換を使用して、音響特徴から高品質な音声波形を合成する高速なニューラルボコーダー。
data-prep-kit/data-prep-kit
LLMの事前学習、ファインチューニング、RAGアプリケーション向けに、非構造化データをクリーニング、変換、拡張するためのスケーラブルなツールキット。
senstella/parakeet-mlx
Apple Silicon向けにNvidiaのParakeet ASRモデルをMLXベースで実装したもので、ストリーミングとタイムスタンプのサポートを備えた効率的なローカル音声文字起こしを提供します。
zamalali/DeepGit
キーワードやスター数だけでなく、意図とソースコード分析に基づいて最適なリポジトリを見つけるために、LLMとセマンティックリコールを使用するGitHub向けエージェント型リサーチエンジン。
runesleo/x-reader
YouTube、X、WeChatなど、さまざまなプラットフォームからコンテンツを取得・音声認識・要約し、構造化された形式に変換するユニバーサルコンテンツリーダー。
norlab-ulaval/libpointmatcher
ロボット工学およびコンピュータビジョンにおける3D点群の整列に使用する、Pythonバインディング付きのモジュール式C++ライブラリ。
owensgroup/RXMesh
GPU加速された三角メッシュ処理ライブラリで、幾何処理タスク用に統合された行列インフラストラクチャと自動微分を備えています。
cubezhao/ai-tools-mng
AIアカウント、サブスクリプション、メールを管理するクロスプラットフォームのデスクトップマネージャーで、ワンクリックでのアカウント切り替えとサブスクリプション追跡を提供します。
NaturalIntelligence/imglab
COCO や Pascal VOC などのフォーマットをサポートする、オブジェクト検出器のトレーニングデータ作成用のウェブベースの画像ラベリングツール。
AI-Anywhere/AI-Anywhere
デスクトップまたはモバイルの任意のブラウザから、tmuxベースのAIエージェントCLIセッションにアクセス・管理するためのウェブインターフェースと管理レイヤーです。
PoseLib/PoseLib
カメラ姿勢推定のための最小ソルバーとロバスト推定器のコレクション。多様な対応関係とカメラモデルをサポートし、依存関係を最小限に抑えています。
bcmi/libcom
現実的なオブジェクト挿入を可能にする統一されたツールセットを提供する画像合成ツールボックス。調和、影生成、配置評価を含む。
PozzettiAndrea/ComfyUI-SAM3
MetaのSAM3用のComfyUI統合で、自然言語のテキストプロンプトを使用してオープンボキャブラリ画像および動画セグメンテーションを実現します。
Laxcorp-Research/project-raven
ローカルストレージとBYOK APIキーを使用して、ステルスオーバーレイによるリアルタイムAI支援と、会議終了後の自動要約を提供するオープンソースのミーティングコ・ピロット。
qibin0506/Cortex
ゼロから軽量な0.1B MoE大規模言語モデルを構築するためのフルライフサイクルトレーニングパイプラインを提供するオープンソースプロジェクト。事前学習、SFT、RLHFを含む。
tin2tin/Pallaidium
Blender Video Editorに統合された生成AI映画スタジオで、AI生成された動画、音声、テキストを使って、フルフィルム制作をプロトタイピングできる。
reczoo/FuxiCTR
FuxiCTRは、クリックスルー率予測のためのオープンソースPythonライブラリ(PyPIパッケージ)です。PyTorchおよびTensorFlow用に実装された40以上の現代的なCTRモデル(古典的な因子分解機型と最近のシーケンス対応アーキテクチャ)をバンドルしています。設定の柔軟性、自動ハイパーパラメータチューニング、再現可能なベンチマーク、拡張のしやすさを重視しており、広告、レコメンデーション、スポンサード検索システムの研究者やエンジニアにとって有用です。
Azure-Samples/openai
Azure AI Foundry と Azure OpenAI Service を使用してエージェントワークフローおよびAIソリューションを構築するための実用的なコードサンプルとテンプレートのコレクション。
lonr-6/cc-desktop-switch
Claude Desktop ユーザーがローカルゲートウェイを介して、サードパーティの Anthropic互換 API プロバイダーを管理・切り替えできる軽量デスクトップアプリケーション。
alinaqi/maggy
Claude Codeにマルチモデルルーティング、TDDの強制、隔離された並列エージェント実行を追加するエンジニアリングハーネス。自己レビュー型開発システムを構築する。
ThinkInAIXYZ/go-mcp
外部システムとAIアプリケーション間のシームレスな通信を可能にする、Model Context Protocol (MCP) のGo実装SDKです。
vercel-labs/bash-tool
AIエージェントがサンドボックス環境内でシェルコマンドを実行し、ファイルを管理できる汎用的なバッシュツールです。
MaestroError/LarAgent
Laravel用のAIエージェント開発フレームワークで、Eloquent風APIとLaravelスタイルのツールを用いてAIエージェントの作成と保守を可能にします。
microsoft/multilspy
AI駆動のコード生成やエージェントをサポートするため、複数の言語サーバーから静的解析結果を照会するための統一 API を提供する Python LSP クライアントライブラリ。
MIV-XJTU/JanusVLN
JanusVLNは、エムベデッドエージェントのための視覚言語ナビゲーションフレームワークであり、意味理解と3D空間認知を分離し、相互に補完する二重暗黙的記憶システムを用いて、両者の統合を実現します。
Kaixhin/imitation-learning
SACをベースに、GAILやREDなどのディープインミテーションラーニングアルゴリズムを統合的にベンチマーク・実装するフレームワーク。Gym MuJoCo環境で検証済み。
Sharrnah/whispering
ストリーミングオーバーレイやゲーム内利用向けに設計された、リアルタイム音声認識・翻訳およびOCRを実行するローカルでオープンソースのツール。
dseditor/QwenASRMiniTool
Qwen3-ASRとWhisperモデルを基にしたローカルオフライン音声認識字幕生成ツール。音声・動画・マイク録音をSRT字幕に変換可能。CPUまたはGPU加速に対応。複数の特化言語モデル、話者分離、カラオケ文字単位ハイライトを内蔵。コマンドラインインターフェースとOpenAI互換APIを提供。
anaisbetts/mcp-youtube
yt-dlpを用いてYouTube字幕をダウンロード・読み取り、AIアシスタントが動画の要約や分析を行うことを可能にするModel Context Protocolサーバー。
papercomputeco/stereOS
AIエージェントを安全に実行するために特別に設計された、強化され最小限のLinuxオペレーティングシステム。専用のオーケストレーションデーモンと再現可能なイメージビルドを備えています。
UCSC-VLAA/OpenVision
マルチモーダル学習向けのオープンソースでコスト効率の良いビジョンエンコーダーのファミリー。理解と生成のタスクにおいて、トレーニング効率と性能を最適化しています。
Seeed-Studio/OSHW-reCamera-Series
エッジAI向けに統合NPUを備えたAI駆動ビジョンモジュール「reCameraシリーズ」のハードウェアドキュメントおよび設計リソースハブ。
BeamNG/BeamNGpy
BeamNG.tech 用の Python API で、車両シミュレーションのリモート制御、センサデータの収集、AI駆動の車両挙動を研究およびロボティクスに活用できます。
atopos31/llmio
複数の AI プロバイダー向けに統合 REST API、重み付きスケジューリング、詳細な監視機能を提供する Go ベースの LLM ロードバランシングゲートウェイ。
JayantDevkar/claude-code-karma
ローカルの JSONL ファイルから Claude Code セッションデータを読み取り、コスト、トークン使用量、ツール活動に関する分析を提供するローカル優先ダッシュボード。
papercomputeco/tapes
コンテンツアドレス指定されたLLM相互作用のための耐久性のあるストレージとOpenTelemetryインストルメンテーションを提供するエージェントテレメトリシステム。
jtydhr88/ComfyUI-HY-Motion1
HY-Motion 1.0に基づくテキストから3D人間の動きを生成するComfyUIプラグイン。プロンプト最適化とGLB・FBXへのエクスポートを備える。
CellProfiler/CellProfiler
CellProfilerは、プログラミングやコンピュータビジョンの専門知識がなくても、数千枚の画像から自動的かつ定量的に表現型を測定できるオープンソースのソフトウェアです。
rburkholder/trade-frame
オプション・コンボの追跡、リアルタイムのギリシャ値の計算、および複数ブローカー間での取引執行のための専門ツールを提供する、高容量・低レイテンシ取引向けの C++ フレームワーク。
chenxiachan/xhs-claude-skills
Claude Codeプラグインで、Xiaohongshu投稿を構造化されたObsidianノートに変換し、画像OCRと動画音声認識をサポート。
inulute/simplexity-ai-app
コミュニティが構築した P AI のネイティブデスクトップラッパーで、グローバルショートカットやトレイ統合といったネイティブシステム機能を追加し、より迅速なAI検索アクセスを実現。
Dao-AILab/causal-conv1d
PyTorch用の高パフォーマンスCUDA実装で、複数の精度とカーネルサイズをサポートする因果的深さ方向1D畳み込み。
chenpipi0807/ComfyUI-Index-TTS
高品質な音声クローンとテキスト to スピーチを実現するComfyUI拡張。多言語対応、感情制御、複数キャラクターの小説構文解析を備える。
TechyNilesh/DeepImageSearch
マルチモーダル埋め込みとベクトルインデックスを使用したテキスト、画像、ハイブリッド検索をサポートする、AI駆動の画像検索システムを構築するための Python ライブラリ。
ray-project/llm-applications
Rayフレームワークを使用して、RAGベースのLLMアプリケーションの構築、スケーリング、本番化を実現する包括的なガイドと実装
NousResearch/Hermes-Bot-Mode
Hermes Agent用のデスクトップ・プラグイン。エージェント・プロファイルを、個別の性格、グループチャット機能、および自動化されたルーチンを備えた、名前付きボットのリストへと変換します。
crate/crate
リアルタイムの大規模データセット分析に適した、NoSQLのスケーラビリティと標準SQLの強力さを統合した分散型SQLデータベース。