Nutlope/easyedit

EasyEdit는 Flux 2와 Together AI로 구동되는 프롬프트 기반 이미지 편집 도구로, 단일 텍스트 프롬프트로 이미지를 수정할 수 있습니다.

mmartial/ComfyUI-Nvidia-Docker

NVIDIA GPU 가속을 지원하는 ComfyUI Stable‑Diffusion 웹 UI를 실행하는 Docker 이미지로, GPU 전용 태그, UID/GID 매핑, 그리고 ComfyUI‑Manager 내장으로 간편한 업데이트를 제공합니다.

SerialLain3170/adeleine

색상 힌트, 텍스트 태그 또는 참조 이미지를 통해 안내할 수 있는 선화 자동 색칠을 위한 딥러닝 프레임워크입니다.

Bing-su/adetailer

Stable Diffusion 웹 UI용 확장 기능으로, 생성된 이미지의 세부 사항을 개선하기 위해 마스크 및 인페인팅을 자동화합니다.

cocktailpeanut/fluxgym

Flux Gym은 12-20GB GPU에서 FLUX LoRA를 훈련할 수 있는 Gradio 기반 Web UI입니다. Kohya-ss 스크립트를 래핑하여 자동 모델 다운로드 및 Hugging Face 게시 기능을 제공합니다.

deepgenteam/deepgen

DeepGen 1.0은 이미지 생성, 편집, 추론을 하나의 프레임워크에 통합한 경량 5B 파라미터 통합 다중모달 모델입니다.

nihui/zimage-ncnn-vulkan

모든 Vulkan 호환 GPU에서 고성능 이미지 생성, 인페인팅, ControlNet 지원을 가능하게 하는, ncnn 기반의 포터블 Z-Image 생성기 구현입니다.

Lornatang/SRGAN-PyTorch

생성적 적대 네트워크를 사용하여 세부 텍스처를 복원한 4배 확대된 사진처럼 현실적인 이미지를 생성하는 PyTorch 재구현 SRGAN입니다.

asagi4/comfyui-prompt-control

복잡한 AI 이미지 생성 워크플로우(LoRA 로딩, 프롬프트 스케줄링, 리전 프로프팅 등)를 수십 개의 노드를 수동으로 연결하는 대신 간단한 텍스트 프롬프트로 제어할 수 있는 ComfyUI 확장 기능입니다.

yanokusnir-ai/one-node-flux-2-klein

ComfyUI 커스텀 노드로, 전체 FLUX.2 [klein] 워크플로우를 하나의 자가 완결형 UI 위젯으로 감싸 복잡한 노드 그래프를 제거합니다.

worldbench/DanceOPD

DanceOPD는 여러 확산 기반 이미지 생성 능력(텍스트-투-이미지, 로컬 편집, 글로벌 편집, 사실성 등)을 하나의 모델로 응축하는 연구용 라이브러리입니다. 각 교사 모델을 속도장(velocity field)으로 취급하여 학생 모델의 자체 Rollout 상태에서 쿼리하고, 단순한 속도-MSE 손실을 사용하여 학습합니다. 이 저장소는 SD-3.5-Medium 및 Z-Image 백엔드를 지원하며, 소량의 스모크 테스트(smoke-test)와 LoRA 어댑터를 사용한 전체 학습을 위한 스크립트/설정을 제공합니다.

hustvl/ControlAR

ControlAR는 에지, 깊이 또는 마스크를 통한 공간 가이드를 사용하여 자기회귀 모델의 제어 가능한 이미지 생성을 제공하며, 임의 해상도를 지원합니다.

wafer-bob/ASASR

ASASR는 FLUX.1-dev 기반의 충실한 이미지 슈퍼레졸루션 프레임워크로, 적대적 소볼레프 정합을 사용해 아티팩트를 줄이고 확대된 이미지의 구조적 충실도를 향상시킵니다.

bentoml/BentoDiffusion

BentoML 프레임워크를 사용하여 다양한 Stable Diffusion 계열 모델을 셀프 호스팅하고 배포하기 위한 예제 프로젝트 모음입니다.

shiimizu/ComfyUI_smZNodes

AUTOMATIC1111의 프롬프트 파싱 및 임베딩을 재현하는 사용자 정의 ComfyUI 노드(클립 텍스트 인코딩++ 및 설정)로, stable-diffusion-webui와 ComfyUI 간에 동일한 이미지 생성이 가능합니다.

Windsander/ADI-Stable-Diffusion

ONNXRuntime을 사용하여 여러 플랫폼에서 Python 없이 고성능으로 Stable Diffusion 모델을 추론할 수 있는 C++ 라이브러리 및 CLI 도구.

mrhan1993/Fooocus-API

Fooocus를 위한 FastAPI 기반 REST API로, 수동 매개변수 조정 없이 프로그래밍 방식으로 고품질 이미지를 생성할 수 있습니다.

melMass/comfy_mtb

ComfyUI를 위한 커스텀 노드 모음으로, 추가 유틸리티 도구를 통해 이미지 생성 워크플로우를 확장합니다.

lobehub/sd-webui-lobe-theme

AI 이미지 생성의 워크플로우와 시각적 경험을 향상시키는, Stable Diffusion WebUI용 현대적이고 고도로 사용자 정의 가능한 인터페이스 프레임워크입니다.

yejy53/RealGen

RealGen은 강화 학습 중에 AI 탐지기를 보상 신호로 사용하여 아티팩트를 줄이고 매우 사실적인 이미지를 생성하는 텍스트-이미지 생성기입니다.

cure-lab/MMA-Diffusion

멀티모달 적대적 공격을 사용하여 프롬프트 필터와 안전 검사기를 우회하고 NSFW 콘텐츠를 생성함으로써 Text-to-Image 모델의 보안을 평가하기 위한 프레임워크입니다.

ATH-MaaS/Ovis-Image

Ovis-Image는 7B 파라미터 텍스트‑투‑이미지 모델로, 고품질 텍스트 렌더링과 레이아웃 정밀도를 최적화했으며, 일반적인 하드웨어에서도 효율적으로 실행되도록 설계되었습니다.

nachifur/RDDM

고품질 이미지 복원 및 생성을 위한 잔차 디노이징 확산 모델 프레임워크로, 비 제거, 블러 제거 등의 작업을 지원합니다.

viiika/Meissonic

Meissonic은 소비자용 GPU에서 실행되도록 설계된 효율적인 고해상도 텍스트-이미지 합성을 위한 비자기회귀 마스크 생성 트랜스포머입니다.

nxnai/Voost

Voost는 통합된 Diffusion Transformer로, 고품질 양방향 가상 착용 및 탈의를 가능하게 하여 사용자가 사람 이미지에 옷을 추가하거나 제거할 수 있습니다.

Ammmob/PixelSmile

PixelSmile은 인간 및 애니메이션 캐릭터 이미지에서 신원을 유지하면서 감정을 변경할 수 있는 세밀한 얼굴 표정 편집 도구입니다.

nekhtiari/image-similarity-measures

두 이미지 간의 8가지 표준 이미지 유사도 지표(RMSE, PSNR, SSIM, FSIM, ISSM, SRE, SAM, UIQ)를 계산하는 Python 패키지와 CLI입니다. pip로 설치 가능하며, 선택적으로 성능 향상을 추가할 수 있으며, `image-similarity-measures` 명령어 또는 코드 내 `evaluation` 함수를 통해 사용할 수 있습니다. 특히 원격 감지 환경에서 이미지 처리 또는 AI 모델의 정량적 평가에 유용합니다.

Stability-AI/stability-sdk

Python 라이브러리 및 명령줄 도구를 통해 이미지 생성, 업스케일링 및 애니메이션을 가능하게 하는 Stability API용 클라이언트 SDK입니다.

mo-browser-apps/icons

AI를 사용해 .icns 형식의 macOS 앱 아이콘을 생성하는 데스크톱 앱으로, 사용자는 원하는 디자인을 설명하고 결과를 반복적으로 개선할 수 있다.

HalfAI1102/anthropic-art

Anthropic의 시각 스타일로 손그림 에디토리얼 일러스트레이션을 생성하여 추상적인 개념을 미니멀한 시각적 은유로 변환하는 에이전트 스킬입니다.

Nutlope/blinkshot

Juggernaut Lightning Flux와 Together AI를 활용한 오픈소스 실시간 AI 이미지 생성기입니다.

Sygil-Dev/sygil-webui

낮은 VRAM GPU를 위한 최적화가 된 웹 기반 Stable Diffusion 사용자 인터페이스로, 이미지 생성, 확대, 프롬프트 엔지니어링 도구를 제공합니다.

ShuaixinHuang/image-multiple-angles-3d-camera

3D 위젯과 Qwen-Image-Edit-Plus 모델을 사용하여 업로드된 이미지의 카메라 시점을 변경할 수 있는 3D 제어 이미지 생성 도구입니다.

Lakonik/LakonLab

대규모 확산 모델을 실험하기 위한 고성능 코드베이스로, 효율적인 몇 단계 이미지 생성을 위해 고급 플로우 매칭(flow-matching) 및 증류(distillation) 기술을 구현합니다.

Mukosame/Anime2Sketch

딥러닝을 사용하여 일러스트, 애니메이션 아트, 만화를 깨끗한 선화와 스케치로 변환하는 스케치 추출기입니다.

apple-aiml-research/ml-stable-diffusion

Apple Silicon에서 Core ML을 사용하여 Stable Diffusion 모델을 변환하고 실행할 수 있는 툴킷으로, 모바일 배포를 위한 고급 가중치 압축 기능을 제공합니다.

spectertoucanberth/thumbnail-maker-lab

Thumbnail Maker Lab은 벡터 그래픽과 AI 기반 이미지 편집, 일괄 처리를 결합한 프로페셔널한 타일 이미지 제작 툴킷입니다.

cathrynlavery/diagram-design

Diagram Design은 브랜드에 최적화된 정적 HTML + SVG 편집용 다이어그램(아키텍처, 순서도, 차트, 지도 등) 라이브러리를 대량으로 생성하는 AI 에이전트 스킬입니다. 세 가지 시각적 변형을 제공하며, 자동 색상/글꼴 온보딩 및 접근성 지원 기능을 갖추고 있습니다. Claude Code, Codex, Copilot, Factory Droid, Pi, Kiro 및 기타 에이전트 스킬 플랫폼과 통합됩니다.

liujuntao123/smart-excalidraw-next

Smart Excalidraw는 자연어 설명을 LLM(Claude sonnet-4.5 등)을 사용하여 편집 가능한 Excalidraw 다이어그램으로 변환하는 Next.js 웹 앱입니다. 20개 이상의 다이어그램 유형과 자동 화살표 라우팅을 지원하며, 공유 서버 측 LLM(액세스 비밀번호) 또는 개인 API 키 구성을 선택할 수 있습니다. pnpm dev로 로컬에서 실행하거나 호스팅된 데모를 사용하세요.

ramjke/Translumo

Translumo는 화면 영역을 캡처하고 OCR(Windows OCR, Tesseract, EasyOCR)을 실행하며, 소형 ML 모델로 최상의 결과를 선택하고 DeepL/Google/Yandex/Papago를 통해 텍스트를 번역하여 화면에 오버레이로 표시하는 Windows 데스크톱 앱입니다. 게임 내 실시간 사용을 위해 설계되었으며, 다국어 지원, 프록시 로테이션 및 저지연 작동을 지원합니다. 이 프로젝트는 오픈 소스(Apache 2.0)이며 .NET 8, Visual Studio 2022 및 여러 OCR/비전 라이브러리를 사용하여 구축되었습니다.

Picsart-AI-Research/MI-GAN

모바일 기기에 최적화된 경량 GAN 기반 이미지 인페인팅 모델로, SOTA 모델보다 파라미터 수를 대폭 줄이고 추론 속도를 높이면서도 고품질의 결과를 제공합니다.

Physton/sd-webui-prompt-all-in-one

자동 번역, 프롬프트 정리 도구, ChatGPT 통합을 통해 프롬프트 입력 경험을 향상시키는 stable-diffusion-webui용 확장 기능입니다.

TTPlanetPig/Comfyui_TTP_Toolset

Smart Tile 2.0을 포함한 ComfyUI 노드 컬렉션으로, 의미론적 감지와 가변 크기 타일을 사용하여 고해상도 업스케일링을 수행하는 객체 인식형 타일 기반 img2img 워크플로우입니다.

leeguooooo/image-use

OpenAI API 키 없이 기존 ChatGPT 또는 Gemini 구독을 사용해 이미지를 생성할 수 있는 제로의존 Python CLI

groundboxerrespect/Dlls5-auto

REST API를 통해 어떤 이미지도 영화적 조명과 블룸 같은 사실적인 뉴럴 렌더링 미학을 적용할 수 있는 자체 호스팅 이미지 강화 서비스입니다.

HyperGAN/HyperGAN

PyTorch를 기반으로 한 조합 가능한 GAN 프레임워크로 개발자와 아티스트가 생성적 적대망을 쉽게 훈련, 공유, 배포할 수 있습니다.