freestylefly/awesome-gpt-image-2

安定し、制御可能な画像生成のために、散文形式のAI画像プロンプトを再利用可能なコードのようなプロトコルに変換する、構造化されたプロンプトエンジンとテンプレートライブラリ。

yang0/handraw-style

216の番号付き手描きイラストスタイルと、すぐに使える二か国語プロンプトのカレクト、さらにシンプルなWebギャラリー。ユーザーはスタイルIDを選んで主題を追加するだけで、テキストから画像AIで動作するプロンプトが得られ、スタイルを自分で説明しなくても一貫した視覚的トーンを確保できる。

abi/screenshot-to-code

screenshot‑to‑codeは、Gemini、GPT‑5.5、ClaudeなどのLLMを使用して、UIスクリーンショット、モックアップ、または短い画面録画を、すぐに実行可能なフロントエンドコード(HTML/CSS、React、Vueなど)に変換するオープンソースアプリで、オプションでアセット抽出やビジュアルプレビューも可能です。

yanliudesign/mono-color-skill

限られたインクパレットとリソグラフやハーフトーンといった機械的再現技術を用いた、プロフェッショナルな編集印刷を生成するためのデザインシステムとAIスキル。

aldegad/sprite-gen

一連の画像からゲーム用スプライトアトラスを生成するパイプラインで、アイデンティティのロック、背景除去、静止フレームを呼吸するループにアニメーション化するツールを備えています。

Kizzuwatnaa/DLSS5-Autopilot

DLSS 5 Autopilotは、NVIDIAのDLSS 5ニューラルアップスケーリングを、元々搭載されていなかったゲームに自動で追加するWindowsユーティリティです。インストール済みのゲームをスキャンし、ゲームのグラフィックスAPIとユーザーのRTX 20–50 GPUに基づいて、適切なコミュニティアドオン(ネイティブフック、OptiScaler、ブリッジ、フィーダー、RTX Remixなど)を選択。実行時に必要なDLLをダウンロードし、設定ファイルを書き込み、クリーンにアンインストールも可能。多数のランチャーに対応し、フレーム生成オプションを提供、動画/ウェブカメラストリームにも対応、CLIも利用可能。アンチチートシステムの安全チェックも備えています。

GangTailorUpgrade/undress-service

Dress AI Serviceは、オープンソースで自己ホスト可能なFastAPIアプリケーションで、衣類の写真をアップロードし、CLIPで自動タグ付け、ルールベースの論理とオプションのLLM推論でコーデを提案、Stable Diffusion/FLUXでビジュアル化します。DockerまたはローカルPython環境で動作し、SQLite/PostgreSQLにデータを保存。天候対応スタイリング、分析機能、軽量なHTML/Tailwind UIを備えています。

Nutlope/logocreator

LogoCreatorは、Together AIを介してFLUX-2画像モデルを使用してブランド用ロゴを生成するオープンソースのウェブアプリです。Next.js、TypeScript、Radix、Tailwindで構築されており、アカウント不要で、Together AIキーのみで動作します。即時生成、FLUX-1編集、PNG/SVGエクスポート、オプションのレート制限と認証、履歴ダッシュボードなどの機能を備えています。リポジトリには明確なセットアップ手順と、サイズ選択、コスト予測、リファレンスロゴアップロード、有名ロゴの再デザインショーケースといった今後の課題がリストアップされています。

s1dashu/ip-as-logo-skill

一貫した構図とスタイルを持つ、シンプルでかわいらしい、商業的に利用可能なIPマスコットキャラクターを生成するためのAIエージェントスキル。

upscayl/upscayl

Real-ESRGAN と Vulkan を使用して、品質を損なうことなく低解像度画像を拡大・強化する、無料でオープンソースの AI 画像拡大ツールです。

wuyoscar/GPT-Image2-Skill

GPT Image 2 用のプロンプトギャラリーとツールセット。テキストから画像を生成・編集・逆プロンプト化するための CLI とエージェントスキルを備えています。

shitagaki-lab/see-through

単一のアニメイラストを、最大23の意味的に異なるインペイント済みレイヤーに分解し、2.5Dアニメーションおよびリギング用にPSDとして書き出すフレームワーク。

ShuaixinHuang/image-multiple-angles-3d-camera

インタラクティブな3DウィジェットとQwen-Image-Edit-Plusモデルを使用して、アップロードされた画像のカメラ視点を変更できる、3D制御による画像生成ツール。

basketikun/chatgpt2api

ChatGPTのウェブ機能をリバースエンジニアリングし、組み込みのアカウントプール管理機能とともに画像生成および編集サービスを提供する、OpenAI互換のAPIプロキシ。

LiamGvchi/gc-minimal-zine-poster

テーマや写真を、構造化されたプロンプトコンパイルシステムを使って、ミニマルで紙質感のある編集用ポスターに変換するCodexスキル。

T8RIN/ImageToolbox

500 以上のフィルター、AI による背景除去、バッチ処理を備えた効率的な写真編集が可能な Android 向け画像編集ツール。

shanliuling/dsh-image-gen

DeepSeek Harness用のAI画像生成スイートで、チャットベースの生成、バッチ生産スタジオ、マルチモデル比較、およびローカルComfyUI統合を提供します。

facefusion/facefusion

FaceFusionは、画像および動画における顔の交換および編集を行う、高性能な顔操作プラットフォームです。

NVlabs/Sana

SANAは、NVIDIAによるオープンソースで効率性を重視した拡散コードベースであり、高解像度画像および動画生成に適しています。複数のモデルファミリー(SANA、SANA‑1.5、SANA‑Sprint、SANA‑Video/Video 2.0、SANA‑WM、SANA‑Streaming)と強化学習ラッパー(Sol‑RL)を含みます。主な技術として線形アテンション、32倍圧縮のオートエンコーダ(DC‑AE)、デコーダ専用テキストエンコーダ、sCM蒸留を採用し、4K画像生成や1分間の720p動画生成を、同等モデルよりもはるかに少ないGPUコストで実現可能です。リポジトリにはトレーニング/推論スクリプト、Hugging Face上の事前学習済みチェックポイント、Diffusers統合、ComfyUIノード、デモが提供されています。ライセンスはApache 2.0です。

tracefinity/tracefinity

Tracefinityは、AIを活用したWebアプリ(Docker対応)で、紙に描かれた工具の写真をカスタムのGridfinity 3Dプリント可能なボックスに変換します。ローカルのONNXモデルまたはリモートのGemini/Replicateサービスを使用して工具の輪郭を生成し、編集・配置が可能。STL/3MFファイルをエクスポートして印刷できます。

CookSleep/gpt_image_playground

React/TypeScriptで構築されたWeb UI。OpenAI互換の画像生成(gpt-image-2)に対応。テキストから画像、参照画像の編集、バッチ/ストリーミング、透明背景、マルチターンエージェントチャット、ローカルのIndexedDB履歴、複数APIプロファイルをサポート。Vercel、GitHub Pages、Cloudflare Workers、Docker、またはローカルでデプロイ可能。

danielgatis/rembg

CLI、Python ライブラリ、HTTP サーバーとして使用可能な画像背景除去ツール。さまざまな AI モデルとハードウェアアクセラレーションをサポート。

LunarXuan/image-prompt-reverse

AI画像生成ツール向けに、リファレンス画像を高忠実度のポジティブ・ネガティブプロンプトに逆工程するCodexスキル。

worldbench/DiffusionOPSD

DiffusionOPSD は、拡散画像生成モデル(Stable Diffusion 3.5‑M および Z‑Image‑Turbo)の微調整に向けた「オンポリシー自己蒸留」アルゴリズムのオープンソース実装です。固定された行動ポリシーから低ノイズ状態を繰り返し収集し、報酬勾配ステップを用いて明示的なポジティブ/ネガティブターゲットを構築し、それらに一致する新しいポリシーを学習し、EMA を用いて行動ポリシーを更新します。リポジトリには、依存関係のインストール、報酬モデルのチェックポイントのダウンロード、クイックスモークテストの実行、および7つの公開評価器(PickScore、CLIPScore、HPSv2.1/v3、Aesthetic、ImageReward、DeQA)または混合報酬目的のための本格的な分散トレーニングの起動スクリプトが含まれます。報告された結果では、20の設定のうち19でより高いホールドアウトスコアが達成され、先行手法と比較して GPU 時間が40–63 %削減されています。Apache 2.0 ライセンスで提供されています。

ciddwd/overlay-translator

Screen Translator は、画面をキャプチャし、OCR(ML Kit、PaddleOCR、マンガOCR、またはクラウドサービス)でテキストを抽出し、ローカルモデル、LLM、または商用MT APIで翻訳し、浮動ウィンドウに翻訳結果をオーバーレイ表示(または音声読み上げ)する Android アプリです。ゲーム、マンガ、ビジュアルノベル向けのリアルタイム翻訳、画像のバッチ処理、単語レベルの照会、ループ自動翻訳、UIカスタマイズをサポートし、Apache‑2.0 ライセンスで提供されています。

threerocks/hand-drawn-styles

AIエージェントが一貫性があり高品質な画像プロンプトを生成するために使用できる、19の検証済み手描きスタイルのプロンプトレシピからなるツール非依存のライブラリです。

Comfy-Org/ComfyUI-Manager

ComfyUI‑Manager は、視覚的AIワークフローツール ComfyUI 用の機能豊富な拡張機能です。公式レジストリやコミュニティチャネルからカスタムノードやモデルファイルをブラウズ、インストール、更新、有効/無効切り替え、削除できるUIボタンを追加します。スナップショット/復元機能、ワンクリックでワークフロー共有サイトに投稿する機能、自動化用のCLI(`cm‑cli`)、セキュリティ重視のデータ保存も提供します。設定はシンプルな `config.ini` とオプションのpipオーバーライドファイルで行います。手動git clone、ポータブルWindowsスクリプト、`comfy-cli`、Linux venvスクリプトによるインストールが可能です。

HalfAI1102/anthropic-art

Anthropicの視覚スタイルで手描きの編集イラストを生成し、抽象的な概念をミニマリストの視覚的メタファーに変換するエージェントスキル。

llmsresearch/paperbanana

PaperBananaは、マルチエージェントLLM/VLMパイプラインを使用して、メソッドセクションのテキスト(またはデータファイル)を出版用の図や統計プロットに自動変換するオープンソースのPythonツールであり、バッチ実行、会議特有のスタイル、複数のAIプロバイダーをサポートしています。

photoprism/photoprism

PhotoPrismは、データをプライバシー内に保ったまま、AIを使用して写真や動画を自動的にタグ付け、検索、整理できるオープンソースのセルフホスト型Webアプリです。

invoke-ai/InvokeAI

Invoke AI は、ローカルで実行可能なオープンソースのビジュアルメディア生成プラットフォームです。統合キャンバス、ノードベースのワークフロー編集機能、ギャラリー管理、多数の最新テキストから画像生成モデル(Stable Diffusion、Flux、Qwen‑Image など)をサポートするWebベースUIを提供します。ユーザーは提供されたランチャを使ってインストールし、ローカルサーバーを起動して、直感的なブラウザインターフェースで画像の作成や修正が行えます。アーティスト、デザイナー、開発者向けに、柔軟で拡張可能なAI画像生成ツールを提供しています。

carolinaaafy/travel-memory-sticker-card

旅行の写真をコレクタブルなデジタルメモリースティッカー・カードに変換するCodexスキル。

kijai/ComfyUI-KJNodes

ComfyUI‑KJNodes は、視覚的な Stable Diffusion UI(ComfyUI)用のプラグインで、ユーティリティノード、サブグラフ間の Set/Get 機能、多数のキーボード/マウスショートカットを追加し、大規模な生成グラフの構築と保守を容易にします。

lbouaraba/comfyui-krea2edit

Krea 2を用いた指示ベース画像編集用のComfyUIノードパック。二重潜在変数と意味的根拠条件付けにより、高忠実度のアイデンティティ保持を実現。

GiMi-Xiaomi/gimi-illustration-skill

カスタマイズ可能なスタイルと一貫したキャラクターIPを用いて、テキスト記事や脚本を概念図に変換するAIエージェントスキル。

xororz/local-dream

Snapdragon NPUs によるハードウェアアクセラレーションを活用した、Android 用のローカル Stable Diffusion 画像生成アプリケーション。

popopo-99/zy-cinematic-realism

LLMのためのシネマティックなビジュアルワークフロー。物語のアイデアを、AI画像生成器のためのプロフェッショナルでモデル固有のプロンプトに変換し、本物のシネマティックなリアリズムを実現します。

jtydhr88/ComfyUI-See-through

ComfyUIプラグインで、1枚のアニメイラストを深度順序付きのレイヤー化2.5Dモデルに分解し、Live2Dワークフローに特化して設計されています。

Acly/krita-ai-diffusion

生成的 AI ディフュージョンモデルを Krita の描画ワークフローに統合するプラグインで、インペインティング、ライブペインティング、精密な構造制御ツールを提供します。

goohai/Goohaitools-comfyui

プロフェッショナルな画像制作のために設計された、ComfyUI向けの70以上のカスタムノードを含む包括的なツールキット。バッチ処理、自動ID写真作成、および高度なマスク操作に特化しています。

helblazer811/Diffusion-Explorer

拡散モデルとフローベース生成モデルの背後にある幾何学的な直感的な理解を助ける、教育目的のインタラクティブな可視化ツールです。

wzj177/ecommerce-image-suite

AIを活用したツールキットで、eコマース販売者が製品画像を自動分析し、Amazon、Taobao、JD.com、TikTokなどさまざまなスタイルやプラットフォーム向けのプロフェッショナルなマーケティング画像セットを生成できます。

wnby/photo-relic-editorial

実写写真を、同じ画像を用いた控えめで紙の質感を持つ版画バージョンと組み合わせることで、縦長の編集アートワークに変換する Codex スキル。

Hugo-Dz/spritefusion-pixel-snapper

AIによって生成された不揃いで一貫性のないピクセルアートを修正するために、ピクセルを完璧なグリッドにスナップさせ、色を量子化するツール。

liyue-aigc/xianxia-visual-director

Codex/Agentスキル向けのビジュアルディレクションシステム。単純なアイデアを、壮大な東方系仙侠環境の構造的で映画的な画像プロンプトに変換する。

palxiao/poster-design

AIを活用したオープンソースのポスター編集ツールおよびオンラインデザインツール。組み込みのAI背景除去機能と画像生成により、プロフェッショナルなポスターとSNS用グラフィックの作成が可能。

nuyoah-ai-works/nuyoah-xiezhen-prompt

AIポートレート写真用のプロンプト工学スキルで、プロフェッショナルな写真計画を再構成し、複数のショットにわたって一貫したスタイルとキャラクターの再現を可能にします。

willmiao/ComfyUI-Lora-Manager

ComfyUI用の包括的な管理ツールで、LoRAモデルおよびチェックポイントの整理、CivitAIからのダウンロード、適用をスムーズにします。