sdv-dev/SDV

機械学習を用いて実世界のパターンをエミュレートしながらプライバシーを保護する、タブular 合成データを作成するための Python ライブラリです。

infiniflow/infinity

LLMアプリケーション向けに設計されたAIネイティブデータベースで、高密度・疎な埋め込み、テンソル、および全文データにわたる高速なハイブリッド検索を提供します。

Picovoice/porcupine

IoT、モバイル、Webプラットフォーム全体で、常に待機可能な音声対応アプリケーションを構築するための、軽量で高精度なウェイクワードエンジン。

0din-ai/ai-scanner

本番環境へのデプロイ前に脆弱性やジャイルブレイクをテストするための、プローブを使用するオープンソースのWebアプリケーション。

qf-studio/pilot

GitHub, Jira, または Linear からチケットを自動的に取得し、コードを実装して、レビューのためのプルリクエストを作成するAIソフトウェアエンジニア。

Coolver/home-assistant-vibecode-agent

自然言語でHome Assistantの自動化やダッシュボードをAIが自律的に設計・デプロイ・トラブルシューティングできるAIエージェントとMCPサーバー。

dai-hongtao/InkTime

ビジョンモデルを使用して思い出をスコアリングおよびキャプション化し、「歴史上の今日」から最高の写真を毎日表示するAI搭載e-inkフォトフレーム。

Tencent-Hunyuan/Hy3

Hy3は、Tencentが開発した295BパラメータのMoEモデルで、生産性およびエージェントタスクにおける高性能な推論、安定したツールコール、および幻覚の低減を実現しています。

Hao0321/claude-skill-social-post

Claude/Codex スキルで、制御された Chrome セッションを介して Facebook、Instagram、Threads でのソーシャルメディアコメントの下書き、レビュー、(オプションで)投稿を可能にします。ブランドの声を学習し、すべての操作を暗号的に署名されたレジャーデータに記録し、広範な安全チェックとテストスイートを備えています。ライブ投稿はデフォルトで無効です。リポジトリは自動化フレームワークを提供するものであり、プライベートコンテンツは含まれません。

marmotdata/marmot

AIエージェントやチームがテーブル、API、キューなどのデータ資産を発見および理解するためのコンテキストレイヤーを提供するオープンソースのデータカタログ。

NVIDIA/NeMo-text-processing

テキスト正規化および逆テキスト正規化を行うための Python パッケージ。音声処理システムのためのテキスト準備に使用されます。

Rose22/openlumara

トークン効率と個人のライフ管理を重視したモジュール式、ローカル優先のAIエージェントフレームワーク。複数のインターフェースとサンドボックス化されたシェル実行をサポート。

VicBilibily/GCMP

国内の中国製LLMプロバイダーとカスタムAPI互換モデルをGitHub Copilot Chatに統合するVS Code拡張機能。

volcano-sh/kthena

Kubernetes-native な LLM 推論プラットフォーム。モジュール式に制御・データ平面を分離し、スケーラブルでコスト効率の高いモデルサービングを提供します。

JimLiu/baocut

AIコーディングエージェントが自然言語で BaoCut を制御し、自動的にビデオの音声認識、字幕翻訳、タイムライン編集を行うためのエージェントスキルです。

aiskillstore/marketplace

Claude CodeやCodexなどのツールに機能を追加できる、AIエージェントスキルのオープンソースマーケットリポジトリ。セキュアな配布システムとCLIを提供します。

vivekchand/clawmetry

コード変更なしで、32種類の異なるランタイムにわたってツール呼び出し、コスト、セッションの軌跡を追跡するAIコーディングエージェント向けの監視・観測ダッシュボード。

zy-zmc/tianming-novel-ai-writer

LLMのコンテキストウィンドウに頼らず、物語要素を構造化されたデータと状態スナップショットとして管理することで、長期的な物語の一貫性を保証するAI駆動の小説執筆システム。

ZJU-LLMs/OpenStory

LLMを活用してインタラクティブな物語世界を生成するマルチエージェントシミュレーションフレームワーク。単一の自然言語プロンプトから完全なシミュレート環境を生成できる機能を備える。

casys-kaist/LLMServingSim

ヘテロジニアスなハードウェアと並列化戦略をモデル化して推論パフォーマンスを最適化する、LLMサービングインフラストラクチャ用のサイクルレベルのシミュレータ。

jamditis/claude-skills-journalism

Claude CodeとCodex向けのモジュール式エージェントスキルのコレクションで、ジャーナリストや研究者にソース検証、記録要求、専門的なレポート作成のための専門ワークフローを提供します。

mc3545dada/mspm0-skill

SysConfigとハードウェアツールチェーンと直接対話することで、AIエージェントがTI MSPM0マイコンの設定、ビルド、フラッシュ、デバッグを可能にするルールとスクリプトのセットです。

github/copilot-plugins

GitHub Copilot の公式および外部プラグインのコレクションです。スキル、フック、および Model Context Protocol (MCP) サーバーを通じて、その機能を拡張します。

NVIDIA/IsaacTeleop

ロボット学習のための人間のデモンストレーションデータを合理化するために設計された、高忠実度のエゴセントリックおよびロボット工学データ収集のための統一フレームワーク。

AlexsJones/llmserve

推論バックエンドとローカルモデルファイルを自動検出してLLMの提供を簡素化する、TUIベースのモデルマネージャー兼サーバーランチャー。

fluxions-ai/vui

Vui は、音声文字起こし、ローカル LLM、およびストリーミング TTS モデル(Vui Nano, 300M パラメータ)を組み合わせた、オープンソースのリアルタイム音声アシスタント・スタックです。WebRTC/WebSocket パイプライン、ターン・テイキング、割り込み(barge-in)、OpenAI Realtime-API 互換性、ワンショット音声メモ HTTP エンドポイント、プラグイン可能な ASR (faster-whisper または Moonshine) と LLM バックエンド (Ollama, vLLM, OpenAI 互換)、ツール・ルーティング、ボイスクローン、およびオプションの Claude スタイルのタスク委任を提供します。ワンライナー・スクリプトまたは Docker-compose でインストール可能。Linux + NVIDIA GPU、macOS + MLX、および Cloudflare Tunnel や Tailscale 経由のモバイルアクセスをサポートします。

PrismML-Eng/Bonsai-Image-Demo

Apple Silicon、Linux、Windows向けのクロスプラットフォームデモ。4 BパラメータのBonsaiディフュージョンモデル用に、macOS(MLX)またはNVIDIA GPU(gemlite + HQQ)上でWebベーススタジオとCLIによる画像生成を提供。

bcollazo/catanatron

大規模なシミュレーションの実行と強化学習エージェントのトレーニングのために設計された、高パフォーマンスなSettlers of CatanシミュレーターおよびAIプレイヤー。

apple-aiml-research/ml-hypersim

Hypersimは、約77,000枚のHDR画像(1.9TB)を含む大規模な合成屋内データセットで、ピクセル単位の幾何学、セマンティクス、素材チャンネルを備え、V‑Rayベースのツールキットにより類似データの生成・編集が可能。深度、法線、セグメンテーション、内在画像分解などのシーン理解モデルの学習・評価に最適化されており、事前に用意されたtrain/val/test分割を含む。

pwilkin/trellis.cpp

GGMLを用いたスタンドアロンのC++実装により、実行時にPythonを必要とせず、画像からテクスチャ付き3Dモデルを生成するTRELLIS画像から3Dへのパイプラインを実現。

automl/auto-sklearn

scikit-learn推定器のドロップインリプレースとして機能する自動機械学習ツールキットで、モデル選択とハイパーパラメータチューニングを自動化します。

robert-mcdermott/ai-knowledge-graph

非構造化テキストから主語-述語-目的語のトリプレットをAIで抽出し、インタラクティブでクエリ可能な知識グラフを生成するシステム。

nunchux-ai/ComfyUI-nunchaku

Nunchaku推論エンジン用のComfyUIプラグインで、画像生成および編集モデルの効率的な4ビット量子化推論を可能にします。

apple-aiml-research/ARKitScenes

モバイルLiDARで撮影された室内シーンの大規模なRGB-Dデータセット。3Dオブジェクト検出および深度アップサンプリングのための真値を提供。

neo4j-contrib/mcp-neo4j

LLMがNeo4jデータベースを照会し、Auraクラウドインスタンスを管理し、永続的な知識グラフ記憶を維持できるようにするModel Context Protocol (MCP) サーバーのコレクションです。

microsoft/BiomedParse

9つの画像モダリティにわたる生物医学的オブジェクトの統合的セグメンテーション、検出、認識を可能にする基礎モデルで、2Dおよび3Dボリューム推論をサポートしています。

MIC-DKFZ/nnInteractive

3D 医療画像向けの最先端の 3D プロンプト可能なセグメンテーションフレームワーク。点、スクライブ、ラッソプロンプトを使ってボリュームマスクを修正できます。

StanfordMIMI/Merlin

Merlinは、CTスキャン用の3D視覚言語基盤モデルおよびデータセットであり、CTスキャンと電子健康記録および放射線レポートを統合して医療分析を行います。

Windecay/ComfyUI-ReservedVRAM

OOMエラーを防ぎ、GPUメモリ使用量を最適化するために、予約されたVRAMをリアルタイムで動的に調整するComfyUIノード。

apple-aiml-research/ml-egodex

EgoDexは、機敏なテーブル上操作を学習するための、エゴセントリック動画と3Dポーズアノテーションがペアになった大規模データセットおよびベンチマークです。

mcpware/cross-code-organizer

AIコーディングツール用のクロスハーネス設定オーガナイザーで、メモリ、スキル、MCPサーバーを管理する統合ダッシュボードを提供し、トークン使用量を最適化し、ツールポイズニングを検出します。

jin-bo/agentao

MCP/ACPを介したツール接続、永続メモリ、厳格な権限制御を提供する、ガバナンス付きのローカルファーストなPython向けエージェントランタイム。

Othmane-Khadri/YALC-the-GTM-operating-system

AIエージェントをセールススタック全体でオーケストレーションし、リードソーシング、適格性判定、パーソナライズされたアウトリーチを自動化する、オープンソースのGTMエンジンでありClayの代替品です。

griddynamics/rosetta

AIコーディングエージェント向けのエンジニアリングガバナンスおよびコンテキストフレームワーク。チーム間で共有される指示、アーキテクチャ標準、およびガバナンスされたワークフローを提供します。

benchflow-ai/benchflow

AI エージェントをタスク環境に対して実行し、標準化された契約を通じて評価するためのユニバーサル環境フレームワーク。ベンチマークを「凍結された環境」として扱う。

brycewang-stanford/StatsPAI

応用因果推論および計量経済学のための Python ネイティブ・ツールキット。実証研究のワークフローにおいて Stata と R の間を切り替える必要性を解消します。

notepower2k1/CapCap

Faster-WhisperやさまざまなTTSエンジンなどのAIモデルを使用して、文字起こし、翻訳、および吹き替えを自動化するビデオローカライズ用のWindowsアプリケーション。

memovai/mimiclaw

ESP32-S3チップ向けに純粋なC言語で実装されたAIアシスタント。ローカルメモリを備え、Telegramを通じてツール呼び出しが可能な、低消費電力の常時起動型エージェントを提供します。