deepfakes/faceswap

画像や動画の顔を認識・交換するための、抽出‑学習‑変換パイプラインを備えたディープラーニングツール。

judge0/judge0

Judge0は、90以上の言語に対して安全なコードコンパイルと実行を統合できる堅牢なサンドボックス化されたオンラインコード実行システムです。

Zipstack/unstract

LLM(大規模言語モデル)を活用したプラットフォームで、PDF や画像などの非構造化ドキュメントを自然言語プロンプトを通じて構造化 JSON データに変換します。

qdrant/fastembed

ONNX Runtime を使用して重い PyTorch 依存を回避し、テキスト、画像、マルチモーダル埋め込みを高速に生成できる軽量かつ高速な Python ライブラリです。

agentrq/agentrq

AgentRQは、人間とLLMエージェント(Claude、Codex、Antigravityなど)がリアルタイムのタスクワークスペースを共有できるようにするオープンソースプラットフォームです。Web UIとネイティブデスクトップアプリ、エージェントがタスクの作成/更新、イベント発火、メモの読み書きなどを呼び出すModel Context Protocol (MCP)を公開するGoベースのバックエンドを提供します。機能には、Kanbanボード、スケジュール/繰り返しタスク、ドラッグ&ドロップのイベント駆動ワークフロー、オンデバイスの自動タイトル生成、音声認識、広範なキーボードショートカットが含まれます。拡張機能でカスタムページやアクションを追加できます。リポジトリには、Docker/セルフホスト手順、ワンライナーのデスクトップインストーラー、`.mcp.json`経由のClaude統合ガイド、ACPゲートウェイ経由の他のエージェントのブリッジングガイドが含まれます。

tailcallhq/forgecode

AI 強化ターミナル開発環境で、TUI、CLI、または ZSH プラグインを通じてコーディングエージェントをシェルに直接統合します。

tutu-zzz/zhilv-yuntu

中国の観光地向けの AI 旅行計画システム。LLM、RAG、Amap 統合を組み合わせ、天気対応の構造化された地図検証済み旅行計画を生成する。

PocketRisu/PocketRisu

マルチデバイスアクセスとサーバー側でのレスポンス生成を可能にする、セルフホスト型のAIロールプレイチャットプラットフォーム。

nregret/Comfyui-Anima-Tools

アニメAIアート向けに設計されたComfyUI用の視覚的プロンプトとLoRA選択ツール。4万以上のアーティスト、キャラクター、衣装タグのデータベースを備えています。

Achuan-2/SlideSCI

研究者向けの PowerPoint プラグインで、AI アシスタント、LaTeX/Markdown 挿入、高度なレイアウトツールを通じて科学的スライド作成を自動化します。

halide/Halide

C++ と Python に埋め込まれたプログラミング言語で、多様なハードウェアアーキテクチャ上で高パフォーマンスな画像および配列処理コードを記述することを目的としています。

gglucass/headroom-desktop

AIコーディングエージェントのトークンコストを削減するデスクトップトレイアプリ。ローカル最適化パイプラインを介してリクエストをルーティングし、プロンプトのボリュームを圧縮する。

yaojingang/yao-meta-skill

粗いワークフローとプロンプトを、組み込みの評価とリリースゲートを持つ再利用可能でクロスプラットフォーム対応のAIエージェントスキルパッケージに変換するガバナンスおよびエンジニアリングシステム。

ray-project/kuberay

分散AIワークロード(LLMトレーニングや推論など)向けに、Rayクラスタのデプロイ、オートスケーリング、管理を簡素化するKubernetes Operatorです。

vstorm-co/full-stack-ai-agent-template

FastAPIとNext.jsを使用して、RAG、認証、エンタープライズ統合機能を備えたフルスタックAIエージェントアプリケーションを構築するための、プロダクション対応プロジェクトジェネレーター。

vercel-labs/open-agents

Vercel 上でバックグラウンド・コーディング・エージェントを構築・実行するためのオープンソースの参照アプリです。デカップリングされたエージェント・ランタイムと、隔離されたサンドボックス環境を特徴としています。

bostrot/wsl2-distro-manager

Windows用のWSLおよびmacOS用のネイティブVMを管理するGUIで、MCPサーバーとAIアシスタントを備え、Linux環境を実際に操作・構成できるようにします。

s0xDk/refactoring-ui-skill

Claude Code スキルで、『Refactoring UI』という書籍から具体的かつ機械的なデザインルールを AI に教え、プロフェッショナルな見栄えのユーザーインターフェースを作成させます。

homeassistant-ai/skills

AIコーディングエージェントにHome Assistantのベストプラクティスを教え、一般的な設定エラーを防ぐためのポータブルな知識パックのコレクションです。

ByteDance-Seed/VeOmni

VeOmniは、モジュール式でトレーナーレスな設計により、さまざまなハードウェアアクセラレータを使用して、シングルおよびマルチモーダルモデルの事前学習および事後学習をスケールアップするための多用途なフレームワークです。

Tencent-Hunyuan/HunyuanOCR

軽量でエンドツーエンドのOCR視覚言語モデル。構造化テキスト抽出を高速化するための指示的推論を統合。

pollen-robotics/reachy_mini

AI ビルダー向けのオープンソースで表現力豊かなロボットプラットフォーム。Python/JS SDK と Hugging Face Spaces に統合されたアプリストアを備える。

xerj-org/xerj

トークンコストを削減し、コーディング効率を向上させるために、フォルダを自動的にインデックス化するローカルAI検索エンジン。エージェントが正確なコードやドキュメントを取得できるようにします。

FuJacob/cotabby

macOS 向けのオープンソースでローカルファーストの AI 自動補完ツール。デバイス内モデルを使用して、システム全体にわたるインラインテキスト補完を提供。

alpacahq/alpaca-mcp-server

Alpaca取引APIを介して、株式、オプション、暗号通貨の取引操作の実行と市場データの取得をAIアシスタントに可能にするMCPサーバー。

HorizonRobotics/EmbodiedGen

体現型 AI 用に、テキストと画像をシミュレーション対応の 3D アセットおよび環境に変換する生成型 3D ワールドエンジン。複数のロボットシミュレータで展開可能。

aurekaresearch/OpenDDE

すべての原子を扱う生体分子基盤モデルで、創薬における構造予測、設計、最適化に向けた共フォールディングを実現。

khoj-ai/openpaper

検証可能な引用と論文間の統合を備えた、AI駆動の研究用ワークスペース。

microsoft/conductor

YAML設定とGitHub Copilot SDKを使用して、決定的でバージョン管理されたマルチエージェントワークフローを定義および実行するためのCLIツール。

ThorOdinson246/whatisit-nl2sh

ファインチューニングされたQwen2.5-Coderモデルを使用して、自然な英語のリクエストをシェルコマンドに変換するローカルCLIツール。危険な操作に対する組み込みのセーフティチェッカーを搭載しています。

Minara-AI/minara-skills

自然言語を使って、AIエージェントが株式、暗号資産、為替を取引し、複数のブロックチェーン上でウォレットを管理できるようにするスキルのセット。

Nerogar/OneTrainer

データセット作成、ファインチューニング、モデル変換のツールを提供する、GUI または CLI で操作できる拡散モデル向けの包括的なトレーニングスイートです。

qualcomm/ai-hub-apps

Android、Windows、およびUbuntuにわたるQualcomm Snapdragonデバイス上で、機械学習モデルをデプロイおよび最適化するためのサンプルアプリとチュートリアルのコレクション。

TongjiSuperPower/sp_vision_25

ニューラルネットワークによる検出と軌道計画を用いて命中率を最大化し、撃破時間を最小化する、戦闘用ロボット向けのオープンソース自動照準・火器制御システム。

Xilinx/finn

AMD Research が開発した実験的フレームワークで、カスタマイズされたデータフロー型アーキテクチャを生成することで、FPGA 上での量子化ニューラルネットワークの高速かつスケーラブルな推論を実現します。

hiyouga/EasyR1

視覚言語モデルと GRPO などの複数の強化学習アルゴリズムをサポートする、効率的かつスケーラブルな強化学習トレーニングフレームワーク

sdatkinson/neural-amp-modeler

ギターアンプやオーディオ機器の挙動をモデル化するためにニューラルネットワークを訓練するためのツールキットです。訓練したモデルはリアルタイムで使用するためにエクスポート可能です。

harry0703/AudioNotes

記録された音声および動画を構造化されたMarkdownノートに変換し、コンテンツに対してAI駆動のQ&Aを可能にするローカルファースト型のトランスクリプションツール。

Alibaba-Quark/LiveAvatar

Live Avatarは、音声(およびオプションの参照画像またはテキストプロンプト)を入力として、連続的かつリアルタイムの会話アバター動画を生成する研究レベルのシステムです。140億パラメータの拡散モデル(WanS2V-14B)をLoRAでファインチューニングし、ブロック単位の自己回帰処理により、マルチGPU H800環境で約45 FPSのストリーミングを実現。10,000秒以上の動画生成も可能。Condaベースのインストール、マルチGPUおよびシングルGPU推論スクリプト、オプションのFP8量子化とJITコンパイルによる高速化、Gradio UIを提供。モデル重みはHugging FaceでApache 2.0ライセンスで公開されています。

kennss/SiliconScope

sudo 不要の Apple Silicon システムモニター。AI およびメディアワークロードに対して、Neural Engine、Media Engine、メモリ帯域幅の深い可視性を提供します。

orneryd/NornicDB

Neo4j 互換のグラフデータベースで、AI エージェントのメモリと Graph-RAG のために、ベクトル検索と履歴バージョン管理を1つのエンジンに統合。

microsoft/RAMPART

エージェント型AIアプリケーションのセキュリティと安全性を評価するための、pytestに統合された赤チーム作業用フレームワーク。

dongbeixiaohuo/writing-agent

Writing-Agent は Windows 互換で、Claude Code で駆動されるツールで、証拠追跡、事実確認、AIトーンの除去を備えた多段階で再現可能な記事作成パイプラインを実現します。CLI、プラグイン、またはプレビュー用デスクトップアプリで動作し、deepseek-v4-flash などの低コストな Anthropic 互換モデルもサポートします。

Zarxrax/Sammie-Roto-2

SAM2やMatAnyoneなどのモデルを使用した、AI支援のビデオマスキング、セグメンテーション、オブジェクト除去のためのクロスプラットフォームデスクトップアプリケーション。

snakers4/silero-models

CPUおよびGPU上での効率的な実行を目的として設計された、幅広い言語をサポートする高速なエンドツーエンドのテキスト読み上げ(TTS)モデルのコレクション。

neuml/txtai

セマンティック検索、LLM オーケストレーション、言語モデルワークフローを統合したオールインワン AI フレームワークで、RAG と自律エージェント用の組み込み埋め込みデータベースを備えています。

agentclientprotocol/registry

Agent Client Protocol (ACP) を実装し、ユーザー認証をサポートするAIエージェントの選別されたレジストリ。クライアントアプリケーション向けの発見メカニズムを提供。

jahala/tilth

アウトライン、定義優先の検索、およびコールチェーンの追跡を提供することで、AIエージェントがコードベースをより効率的に読み取れるようにする、構造的なコードナビゲーションツールおよびMCPサーバー。