Steve-Mr/EmojiFace
FaceMoji(EmojiFace)は、YOLOv8‑face モデルを使用してローカルで顔を検出し、絵文字やぼかし効果を重ねる Android および Web アプリです。オフラインで動作し、手動編集が可能で、カスタム絵文字フォントもサポート。共有専用起動用の非表示アイコンアプリとしてインストールも可能。
tmchow/illo-skill
繰り返し登場するマスコットを使用して、アイデアを視覚的に表現するプリントスタイルのイラストや図解を生成する AI エージェント用プラグイン。
mirabarukaso/character_select_stand_alone_app
AI画像生成のためのスタンドアロンインターフェース。視覚的なキャラクター選択、半自動タグ補完、ComfyUIおよびForge NeoとのAPI統合を提供します。
lquesada/ComfyUI-Inpaint-CropAndStitch
マスクされた領域をクロッピングし、ターゲット解像度で処理してから、元の画像にシームレスに再統合することで、インペイントの最適化を実現するComfyUI拡張です。
RoseKhlifa/Image-Studio
SSE および WebSocket モードを使用して、長時間の推論タスク中に接続タイムアウトを防ぐクロスプラットフォームの画像生成および編集クライアント。
nova452/Rebalance-Pack
Krea 2およびIdeogram 4モデルの特化サポートを備え、画像生成と編集を効率化するカスタムComfyUIノードのコレクション。
framepipe-dev/media-inference-worker
テキストプロンプトで内部画像生成サービス(例:qwen-image-3)を呼び出す小さなPythonクライアント。依存関係をインストールし、モデル名とプロンプトを指定して `generate.py` を実行し、他のエンドポイントについては `RUNBOOK.md` を参照してください。
ShiftHackZ/Stable-Diffusion-KMP
AndroidおよびiOS向けに、セルフホストのStable Diffusionサーバー、クラウドAPI、およびデバイス上のローカルランタイムに接続できる、オープンソースのクロスプラットフォームAI画像生成クライアント。
civitai/civitai
Stable Diffusion モデルと AI 生成カスタマイズの共有、発見、共同作業を可能にするコミュニティプラットフォーム。
Kosinkadink/ComfyUI-Advanced-ControlNet
キーフレームとカスタムウェイトを使用して、タイムステップ全体およびバッチ化された潜在変数にわたる強度を精密に制御できる、高度なControlNetスケジューリングのためのComfyUIノードセット。
Azornes/Comfyui-LayerForge
ComfyUI 用のレイヤー付きキャンバスエディタで、ブラウザ内で画像合成、多角形インペインティング選択、背景除去が可能。
Code-with-Beto/snapai
OpenAIとGoogle Geminiの画像モデルを使用して、モバイル開発者がアプリアイコンとGoogle Playの特徴グラフィックを生成するためのCLIツール。
unconv-ai/Un-0
拡散や反復的ノイズ除去ではなく、結合されたオシレーターの統合によって画像を生成する、Kuramoto 動力学に基づく画像生成モデル。
TeamMoeAI/MoeSR
ディープラーニングモデルを活用して、ACGNイラスト、CG、マンガに特化した画像のスーパーレゾリューションおよび修復を実現するツール。
ssitu/ComfyUI_UltimateSDUpscale
タイル分割(tiled)方式を用いて大きな画像をイメージ・トゥ・イメージ拡散処理することで、詳細度を向上させ、ハードウェア要件を軽減する ComfyUI ノードのセットです。
vladmandic/sdnext
Stable Diffusionに基づいたAI画像・動画生成のための、高度なメモリ最適化と幅広いハードウェアサポートを備えた包括的なWebインターフェース。
facebookresearch/stable_signature
生成 AI モデルの LDM デコーダに不可視ウォーターマークを直接埋め込むシステムで、AI 生成画像を自動的に識別します。
yuanchenyang/smalldiffusion
U‑Net と DiT アーキテクチャの実験を容易にする、拡散・フローモデルの学習とサンプリング用の軽量ライブラリです。
Topkill/tianruoocr
TianRuo OCR v6 は、画面のテキストをキャプチャし、PaddleOCR/RapidOCR を通じてオンラインまたはオフラインで OCR を実行し、多数のオンライン翻訳サービスで翻訳する Windows デスクトップアプリです。通常、サイレント、スクリーンショット、クリップボードリスンモードをサポートし、カスタムショートカットが可能で、印刷テキスト、表、手書きテキストの認識に対応しています。
cardenluo/ComfyUI-Apt_Preset
ComfyUI‑Apt_Presetは、ビジュアルAIワークフローツールComfyUI向けのプラグインです。読み込み、control-net、サンプリングのステップをプリセット駆動のノードにバンドルし、多くのモデルファミリー向けのユニバーサルローダー、動画/アニメーション/control-net向けのコントローラースタック、統合サンプラーノード、およびユーティリティ画像/マスクツールを提供します。`custom_nodes` にクローンし、`install.bat` を実行してインストールします。オプションのコンパニオンプラグインとリソースパックで追加の機能を追加できます。このプラグインは複雑な画像生成グラフを簡素化し、構築とメンテナンスを容易にします。
intel/openvino-ai-plugins-gimp
OpenVINO AI プラグイン for GIMP は、Intel OpenVINO を使用して GIMP 3 にオンデバイス AI 機能(スーパーレゾリューション、セマンティックセグメンテーション、および FastSD を含む多数の Stable-Diffusion バリアント)を追加します。Windows/Linux 用のガイドに従ってインストールし、GIMP でモデルを読み込み、直接エディタ内で画像を生成または編集できます。
gmberton/vismatch
vismatchは、SIFT-LightGlue、LoFTR、SuperPoint-LightGlueなど50以上の画像マッチングモデルを1つの使いやすいAPIでラップするPythonライブラリです。モデルのダウンロード、画像の読み込み、マッチング処理、可視化を自動で処理し、バッチ処理用のCLIツールも提供します。最新の視覚的対応手法の実験と比較を簡素化することを目的としています。
chflame163/ComfyUI_LayerStyle
ComfyUIにPhotoshopのようなレイヤーおよびマスク合成機能をもたらし、外部編集ソフトの必要性を軽減するノードセット。
YouMind-OpenLab/nano-banana-pro-prompts-recommend-skill
Nano Banana Pro(Gemini)画像生成モデル用に10,000以上のカスタマイズ済みプロンプトを検索・推薦できるAIエージェントスキル。
wildminder/ComfyUI-DyPE
FLUX や Qwen Image などの Diffusion Transformer (DiT) を、学習なしのモデルパッチングとカスケード細化技術を用いて、超高解像度(4K+)で生成可能にする ComfyUI カスタムノードパックです。
sepandhaghighi/samila
数学的式とランダムパラメータに基づいて、数千の点を計算することで、ユニークな画像を生成するジェネラティブアートジェネレーター。
wooyeolbaek/attention-map-diffusers
attention‑map‑diffusers は、Hugging Face Diffusers を使用した画像および動画生成パイプラインのアテンションテンソルをキャプチャ・可視化できる Python ライブラリです。プロンプト、画像パッチ、または動画フレームが互いにどのように影響し合うかをユーザーが確認できるようにします。
Tencent-Hunyuan/HY-SOAR
HY-SOAR は報酬不要のポストトレーニング手法で、拡散モデルの露出バイアスを修正し、生成中にモデル自身が軌道エラーを修正できるように学習させます。
SalesforceAIResearch/DiffusionDPO
Direct Preference Optimization を用いて、Stable Diffusion のような画像生成モデルを人間の好みに合わせる Diffusion-DPO のための訓練フレームワークです。
rohitgandikota/sliders
LoRA アダプタを作成するためのフレームワークで、スライダーとして機能し、Stable Diffusion や FLUX などの拡散モデルにおいて特定のビジュアル概念を正確に制御できます。
yejy53/GenClaw
GenClawは、最終的なレンダリングの前に、実行可能な視覚的スケッチ (SVG, HTML/CSS) を制御可能なキャンバスとして使用する、コード駆動型のエージェンティック・フレームワークです。
KohakuBlueleaf/LyCORIS
LoHa や LoKr などのさまざまなパラメータ効率的な微調整アルゴリズムを実装するライブラリ。Stable Diffusion で高品質なモデルカスタマイズを、最小限のストレージと計算リソースで可能にします。
MochiDiffusion/MochiDiffusion
Apple Silicon上でStable DiffusionとFLUX.2 Kleinをローカルで実行するためのmacOSネイティブアプリケーション。Core MLにより、高いパフォーマンスと低メモリ使用量を実現。
EutropicAI/Final2x
AIを使用して画像を拡大するクロスプラットフォームの画像スーパーレゾリューションツールで、カスタムモデルと最新のNvidia GPUをサポートしています。
hako-mikan/sd-webui-regional-prompter
AUTOMATIC1111 の Stable Diffusion WebUI 用のカスタムスクリプトで、画像の異なる領域に異なるプロンプトを指定できるようにし、プロンプトの漏れを防止します。
easydiffusion/easydiffusion
技術的な知識がなくても、強力な画像生成AIをローカル環境で実行できるようにする、Stable Diffusion用のワンクリックインストーラーおよびユーザーインターフェース。
OpenModelDB/open-model-database
詳細なメタデータと視覚的証拠を備えた、600以上のAI画像および動画アップスケーリングモデルを発見・比較・ダウンロードできるコミュニティ主導のデータベース。
runpod-workers/worker-comfyui
RunPod上でComfyUIをサーバーレスで実行できるようにするラッパーで、スケーラブルなAPIエンドポイントを介して複雑な画像生成ワークフローの実行を可能にします。
lynote-ai/ai-image-detector
AI Image Detector は、画像が AI によって生成された可能性を推定するオープンソースの Python ツールです。UnivFD、Sentry、Nonescape、ハイブリッドエンセンブルといった複数の既製バックエンドを搭載しており、単一コマンド (`aidetect detect …`) でファイルまたはフォルダーを処理し、確率とラベルを出力します。オプションの extras で Gradio Web UI や FastAPI サーバーも利用可能です。リポジトリにはベンチマークスクリプト、閾値キャリブレーション、バックエンド選択の明確なガイダンスが含まれています。軽量で一度インストールすればどこでも実行できる AI 画像検出ユーティリティで、汎用的な保証や領域レベルのローカリゼーションはないことが明記されています。
gazingstars123/Anima-Standalone-Trainer
Anima モデルの LoRA 微調整 (LoRA fine-tuning) を行うための、Web UI を備えた軽量なトレーニング環境です。
KohakuBlueleaf/z-tipo-extension
SD-WebUI、Forge、ComfyUI 用のプロンプト拡張拡張機能。TIPO と DanTagGen LLM を使用して、シンプルなタグやキャプションを詳細な画像生成プロンプトに変換します。
boogu-project/Boogu-Image
高品質なテキストから画像生成と正確な画像編集を提供するオープンソースの統合型画像生成・編集モデルファミリー。強力なバイリンガル(中国語-英語)テキストレンダリングを備えています。
ByteVisionLab/DreamLite
DreamLiteは、モバイルデバイス上で完全にオフラインで、1024x1024の画像生成と編集を極めて高速に実行できる、0.39Bパラメータのコンパクトな統合拡散モデルです。
computational-cell-analytics/micro-sam
micro_sam は napari に基づくライブラリで、Meta の Segment Anything モデルをマイクロスコピー用に適応させます。数クリックでインタラクティブな 2D/3D セグメンテーションとトラッキングを可能にし、マイクロスコピー用に微調整された SAM 重みを含み、オプションの自動プロンプト生成と軽量な微調整ツールも提供します。
vvvvvjdy/D-OPSD
D-OPSDは、ステップ蒸留拡散モデルが高速推論能力を維持しながら、新しいスタイルや概念を継続的にチューニングできるようにする、オンポリシー自己蒸留フレームワークです。
pcb9382/PlateRecognition
PlateRecognitionは、YOLO-v5/v7/v8およびTensorRTに基づいた、オープンソースの多地域ナンバープレート検出・OCRシステムです。デスクトップ、サーバー、Android/iOS、および多くのエッジAIチップ上で動作し、最新のハードウェアでは99%以上の精度と50ms未満の延滞を実現します。C/C++およびPython APIを提供し、多くの言語をサポートし、ウェブデモとテストコードが含まれています。
danforthcenter/plantcv
PlantCV は、高スループット植物表型に適したオープンソースのPythonライブラリです。セグメンテーション、特徴抽出などのモジュール式コンピュータビジョン関数をカスタム分析パイプラインに連結できます。pipまたはcondaでインストール可能で、豊富なドキュメント、チュートリアル、および貢献者コミュニティを備えています。
hustvl/Moebius
Moebiusは、アーキテクチャの最適化と知識蒸留により、0.22Bパラメータで10Bレベルの品質と15倍の高速推論を実現する軽量な画像インペイントフレームワークです。