freestylefly/awesome-gpt-image-2
산문 형태의 AI 이미지 프롬프트를 안정적이고 제어 가능한 이미지 생성을 위해 재사용 가능한 코드와 같은 프로토콜로 변환하는 구조화된 프롬프트 엔진 및 템플릿 라이브러리입니다.
yang0/handraw-style
216개의 번호 매겨진 손그림 일러스트 스타일과 즉시 사용 가능한 이중 언어 프롬프트, 그리고 간단한 웹 갤러리로 구성된 컬렉션. 사용자는 스타일 ID를 선택하고 주제를 추가하기만 하면, 텍스트-이미지 AI에서 작동하는 프롬프트를 얻을 수 있으며, 스타일을 직접 설명하지 않아도 일관된 시각적 톤을 유지할 수 있습니다.
abi/screenshot-to-code
screenshot‑to‑code는 Gemini, GPT‑5.5, Claude와 같은 LLM을 사용하여 UI 스크린샷, 목업 또는 짧은 화면 녹화 영상을 즉시 실행 가능한 프론트엔드 코드(HTML/CSS, React, Vue 등)로 변환하는 오픈 소스 앱으로, 옵션으로 에셋 추출 및 시각적 미리보기를 제공합니다.
yanliudesign/mono-color-skill
제한된 잉크 팔레트와 리소그래프, 하프톤과 같은 기계적 재현 기술을 사용하여 전문적인 편집 인쇄물을 생성하는 디자인 시스템과 AI 스킬.
aldegad/sprite-gen
정체성 잠금 생성, 배경 제거, 정지 프레임을 숨 쉬는 루프로 애니메이션화하는 기능을 갖춘, 단일 이미지를 게임용 스프라이트 아틀라스로 전환하는 파이프라인입니다.
Kizzuwatnaa/DLSS5-Autopilot
DLSS 5 Autopilot는 NVIDIA의 DLSS 5 뉴럴 업스케일링을 원래 포함하지 않은 게임에 자동으로 추가하는 Windows 유틸리티입니다. 설치된 게임을 스캔하고, 게임의 그래픽스 API와 사용자의 RTX 20–50 GPU에 따라 적절한 커뮤니티 애드온(네이티브 훅, OptiScaler, 브리지, 피더, RTX Remix 등)을 선택합니다. 런타임에 필요한 DLL을 다운로드하고 설정 파일을 작성하며, 깨끗하게 제거할 수 있습니다. 여러 런처를 지원하고 프레임 생성 옵션을 제공하며, 비디오/웹캠 스트림에도 작동하며 CLI를 제공하고, 앤티치트 시스템에 대한 안전 검사를 포함합니다.
GangTailorUpgrade/undress-service
Dress AI Service는 오픈소스이며 자체 호스팅 가능한 FastAPI 애플리케이션으로, 옷 사진을 업로드하고 CLIP으로 자동 태그를 지정하며, 규칙 기반 논리와 선택적 LLM 추론을 사용해 코디를 제안하고 Stable Diffusion/FLUX로 시각화합니다. Docker 또는 로컬 Python 환경에서 실행되며, SQLite/PostgreSQL에 데이터를 저장하고, 날씨 인식 스타일링, 분석 기능, 가벼운 HTML/Tailwind UI를 포함합니다.
Nutlope/logocreator
LogoCreator는 Together AI를 통해 FLUX-2 이미지 모델을 사용하여 브랜드용 로고를 생성하는 오픈소스 웹 앱입니다. Next.js, TypeScript, Radix, Tailwind으로 구축되었으며, 계정 없이 Together AI 키만으로 작동합니다. 즉시 생성, FLUX-1 편집, PNG/SVG 내보내기, 선택적 레이트 제한 및 인증, 그리고 기록 대시보드 기능을 제공합니다. 리포지토리는 명확한 설정 단계를 제공하며, 크기 선택, 비용 미리보기, 참조 로고 업로드, 유명 로고 재디자인 쇼케이스와 같은 향후 작업 목록도 포함하고 있습니다.
s1dashu/ip-as-logo-skill
일관된 구성과 스타일을 갖춘 단순하고 귀엽고 상업적으로 활용 가능한 IP 마스코트 캐릭터를 생성하도록 AI 에이전트를 안내하는 에이전트 스킬.
upscayl/upscayl
Real-ESRGAN과 Vulkan을 사용하여 품질을 손상시키지 않고 저해상도 이미지를 확대하고 개선하는 무료 오픈소스 AI 이미지 확대기입니다.
wuyoscar/GPT-Image2-Skill
GPT Image 2용 프롬프트 갤러리와 도구 세트로, 텍스트 기반 이미지 생성, 편집 및 프롬프트 역추출을 위한 CLI와 에이전트 기술을 제공합니다.
shitagaki-lab/see-through
단일 애니메이션 일러스트를 최대 23개의 의미적으로 구분된 인페인팅 레이어로 분해하여 2.5D 애니메이션 및 리깅을 위한 PSD로 내보내는 프레임워크.
ShuaixinHuang/image-multiple-angles-3d-camera
3D 위젯과 Qwen-Image-Edit-Plus 모델을 사용하여 업로드된 이미지의 카메라 시점을 변경할 수 있는 3D 제어 이미지 생성 도구입니다.
basketikun/chatgpt2api
ChatGPT의 웹 기능을 리버스 엔지니어링하여 계정 풀 관리 기능과 함께 이미지 생성 및 편집 서비스를 제공하는 OpenAI 호환 API 프록시입니다.
LiamGvchi/gc-minimal-zine-poster
주제나 사진을 구조화된 프롬프트 컴파일 시스템을 사용해 미니멀하고 종이 질감이 느껴지는 편집 포스터로 변환하는 Codex 스킬입니다.
T8RIN/ImageToolbox
500개 이상의 필터, AI 기반 배경 제거, 배치 처리를 지원하는 효율적인 사진 조작이 가능한 Android용 이미지 편집 도구입니다.
shanliuling/dsh-image-gen
DeepSeek Harness용 AI 이미지 생성 스위트로, 채팅 기반 생성, 배치 생산 스튜디오, 다중 모델 비교 및 로컬 ComfyUI 통합을 제공합니다.
facefusion/facefusion
FaceFusion은 이미지 및 동영상에서 얼굴을 교체하고 편집할 수 있는 고성능 얼굴 조작 플랫폼입니다.
NVlabs/Sana
SANA는 NVIDIA에서 제공하는 오픈소스이며, 효율성에 중점을 둔 확산 코드베이스로 고해상도 이미지 및 비디오 생성에 적합합니다. SANA, SANA-1.5, SANA-Sprint, SANA-Video/Video 2.0, SANA-WM, SANA-Streaming 등의 여러 모델 패밀리와 강화학습 래퍼(Sol-RL)를 포함합니다. 주요 기술로는 선형 어텐션, 32배 압축 오토인코더(DC-AE), 디코더 전용 텍스트 인코더, sCM 증류를 사용하여 4K 이미지 생성 및 1분 길이의 720p 비디오 생성을, 유사 모델보다 훨씬 낮은 GPU 비용으로 가능하게 합니다. 리포지토리에는 트레이닝/추론 스크립트, Hugging Face의 사전 학습 체크포인트, Diffusers 통합, ComfyUI 노드, 데모가 포함되어 있으며, 라이선스는 Apache 2.0입니다.
tracefinity/tracefinity
Tracefinity는 AI 기반 웹 앱(Docker 호환)으로, 종이 위 도구 사진을 사용자 정의 Gridfinity 3D 프린트 가능한 박스로 변환합니다. 로컬 ONNX 모델 또는 원격 Gemini/Replicate 서비스를 사용해 도구 윤곽을 생성하고, 편집 및 배열 후 STL/3MF 파일로 내보내 프린팅할 수 있습니다.
CookSleep/gpt_image_playground
React/TypeScript 기반 웹 UI로 OpenAI 호환 이미지 생성(gpt-image-2)을 지원합니다. 텍스트에서 이미지, 참조 이미지 편집, 배치/스트리밍, 투명 배경, 다단계 에이전트 채팅, 로컬 IndexedDB 기록, 여러 API 프로필을 지원하며, Vercel, GitHub Pages, Cloudflare Workers, Docker 또는 로컬에서 배포 가능합니다.
danielgatis/rembg
CLI, Python 라이브러리, HTTP 서버로 사용 가능한 이미지 배경 제거 도구로, 다양한 AI 모델과 하드웨어 가속을 지원합니다.
LunarXuan/image-prompt-reverse
AI 이미지 생성 도구용으로 참조 이미지를 고정밀도의 긍정 및 부정 프롬프트로 역설계하는 Codex 스킬.
worldbench/DiffusionOPSD
DiffusionOPSD는 Stable Diffusion 3.5‑M 및 Z‑Image‑Turbo와 같은 확산 이미지 생성기를 위한 "온-정책 자기-분산" 알고리즘의 오픈소스 구현입니다. 이는 고정된 행동 정책에서 낮은 노이즈 상태를 반복적으로 수집하고, 보상 기울기 단계를 사용해 명시적인 긍정/부정 타겟을 생성하며, 그 타겟을 따라가도록 새로운 정책을 훈련하고, 지수이동평균(EMA)을 통해 행동 정책을 갱신합니다. 이 저장소는 종속성 설치, 보상 모델 체크포인트 다운로드, 빠른 스모크 테스트 실행, 그리고 7개의 공개 평가자(PickScore, CLIPScore, HPSv2.1/v3, Aesthetic, ImageReward, DeQA) 또는 혼합 보상 목표를 위한 전체 규모 분산 훈련을 시작할 수 있는 스크립트를 제공합니다. 보고된 결과에 따르면, 19/20의 설정에서 더 높은 검증 점수를 달성했으며, 기존 방법보다 GPU 시간을 40–63 % 절감했습니다. Apache 2.0 라이선스 하에 배포됩니다.
ciddwd/overlay-translator
Screen Translator는 화면을 캡처하고, OCR(ML Kit, PaddleOCR, 만화-OCR, 또는 클라우드 서비스)로 텍스트를 추출한 후, 로컬 모델, LLM, 또는 상용 MT API로 번역하여 부유 창에 번역 결과를 오버레이하거나 음성으로 읽어주는 안드로이드 앱입니다. 게임, 만화, 비주얼 노벨용 실시간 번역, 이미지 배치 처리, 단어 수준 검색, 반복 자동 번역, 풍부한 UI 커스터마이징을 지원하며, Apache‑2.0 라이선스로 제공됩니다.
threerocks/hand-drawn-styles
AI 에이전트가 일관성 있고 고품질의 이미지 프롬프트를 생성할 수 있도록 도와주는, 19개의 검증된 손그림 스타일 프롬프트 레시피로 구성된 도구 비의존 라이브러리입니다.
Comfy-Org/ComfyUI-Manager
ComfyUI‑Manager 는 시각적 AI 워크플로우 도구 ComfyUI 를 위한 기능 풍부한 확장 기능입니다. 공식 레지스트리 또는 커뮤니티 채널에서 사용자 정의 노드 및 모델 파일을 탐색, 설치, 업데이트, 활성화/비활성화, 제거할 수 있는 UI 버튼을 추가합니다. 스냅샷/복원 기능, 워크플로우 호스팅 사이트에 한 번의 클릭으로 공유하는 기능, 자동화를 위한 CLI (`cm‑cli`), 보안 중심의 데이터 저장소도 제공합니다. 설정은 간단한 `config.ini` 와 선택적 pip 오버라이드 파일로 처리됩니다. 수동 git clone, 포터블 윈도우 스크립트, `comfy-cli`, Linux venv 스크립트를 통해 설치할 수 있습니다.
HalfAI1102/anthropic-art
Anthropic의 시각 스타일로 손그림 에디토리얼 일러스트레이션을 생성하여 추상적인 개념을 미니멀한 시각적 은유로 변환하는 에이전트 스킬입니다.
llmsresearch/paperbanana
PaperBanana는 다중 에이전트 LLM/VLM 파이프라인을 사용하여 메서드 섹션 텍스트(또는 데이터 파일)를 출판용 다이어그램과 통계 플롯으로 변환하는 오픈소스 Python 도구로, 배치 실행, 학회별 스타일링, 다양한 AI 제공자 지원 기능을 갖추고 있습니다.
photoprism/photoprism
PhotoPrism은 데이터를 프라이버시 상태로 유지하면서 AI를 사용하여 사진과 동영상을 자동으로 태그 지정, 검색 및 정리할 수 있는 오픈 소스 셀프 호스팅 웹 앱입니다.
invoke-ai/InvokeAI
Invoke AI는 로컬에서 실행 가능한 오픈소스 시각 미디어 생성 플랫폼입니다. 통합 캔버스, 노드 기반 워크플로우 편집기, 갤러리 관리 기능을 제공하며, Stable Diffusion, Flux, Qwen‑Image 등 수십 가지 최신 텍스트 기반 이미지 생성 모델을 지원합니다. 사용자는 제공된 런처를 통해 설치하고 로컬 서버를 실행한 후 직관적인 브라우저 인터페이스를 통해 이미지를 생성하거나 수정할 수 있습니다. 예술가, 디자이너, 개발자들이 유연하고 확장 가능한 AI 이미지 생성 도구를 필요로 하는 경우에 적합합니다.
carolinaaafy/travel-memory-sticker-card
여행 사진을 수집 가능한 디지털 메모리 스티커 카드로 변환하는 Codex 스킬입니다.
kijai/ComfyUI-KJNodes
ComfyUI‑KJNodes는 시각적 Stable Diffusion UI(ComfyUI)용 플러그인으로, 유틸리티 노드, 서브그래프 간 Set/Get 처리, 그리고 많은 키보드/마우스 단축키를 추가하여 대규모 생성 그래프를 더 쉽게 만들고 유지보수할 수 있도록 합니다.
lbouaraba/comfyui-krea2edit
Krea 2를 사용한 지시 기반 이미지 편집을 위한 ComfyUI 노드 팩. 이중 잠재 및 의미 기반 조건부를 통해 고정밀 정체성 보존을 가능하게 합니다.
GiMi-Xiaomi/gimi-illustration-skill
사용자 정의 가능한 스타일과 일관된 캐릭터 IP를 사용해 텍스트 기사 및 스크립트를 개념도로 변환하는 AI 에이전트 스킬.
xororz/local-dream
Snapdragon NPUs를 활용한 하드웨어 가속을 통해 Android에서 로컬로 Stable Diffusion 이미지 생성을 수행하는 앱입니다.
popopo-99/zy-cinematic-realism
LLM을 위한 시네마틱 비주얼 워크플로우로, 서사적 아이디어를 AI 이미지 생성기를 위한 전문적이고 모델별로 최적화된 프롬프트로 변환하여 실제적인 시네마틱 리얼리즘을 구현합니다.
jtydhr88/ComfyUI-See-through
ComfyUI 플러그인으로 단일 애니메이션 일러스트를 깊이 순서가 있는 레이어화된 2.5D 모델로 분해하며, Live2D 워크플로우에 특화되어 설계됨.
Acly/krita-ai-diffusion
생성 AI 디퓨전 모델을 Krita 페인팅 워크플로에 통합하는 플러그인으로, 인페인팅, 실시간 페인팅 및 정밀 구조 제어 도구를 제공합니다.
goohai/Goohaitools-comfyui
전문적인 이미지 제작을 위한 70개 이상의 커스텀 노드 툴킷으로, 배치 처리, 자동 ID 사진 생성, 고급 마스크 조작에 특화되어 있습니다.
helblazer811/Diffusion-Explorer
확산 모델과 흐름 기반 생성 모델의 기하학적 직관을 설명하는 교육용 대화형 시각화 도구입니다.
wzj177/ecommerce-image-suite
AI 기반 툴킷으로 전자상거래 판매자가 제품 사진을 자동 분석하고 Amazon, Taobao, JD.com, TikTok 등 다양한 스타일과 플랫폼에 맞는 전문적인 마케팅 이미지 세트를 생성할 수 있습니다.
wnby/photo-relic-editorial
실제 사진과 동일한 이미지의 절제된 종이 질감 판화 버전을 짝지어 사진을 세로형 편집 아트워크로 변환하는 Codex 스킬입니다.
Hugo-Dz/spritefusion-pixel-snapper
AI가 생성한 지저분하고 일관성 없는 픽셀 아트의 문제를 해결하기 위해 픽셀을 완벽한 그리드에 맞추고 색상을 양자화하는 도구입니다.
liyue-aigc/xianxia-visual-director
Codex/Agent 스킬용 시각적 디렉션 시스템으로, 단순한 아이디어를 거대한 동방 신현 환경의 구조적이고 영화적인 이미지 프롬프트로 변환합니다.
palxiao/poster-design
내장된 AI 배경 제거 및 이미지 생성 기능을 갖춘 오픈소스 AI 포스터 편집기 및 온라인 디자인 도구로, 전문적인 포스터와 소셜 미디어 그래픽을 쉽게 만들 수 있습니다.
nuyoah-ai-works/nuyoah-xiezhen-prompt
AI 포트레이트 사진을 위한 프롬프트 엔지니어링 기술로, 전문적인 사진 계획을 재구성하여 여러 장의 사진에 걸쳐 일관된 스타일과 캐릭터 재현을 가능하게 합니다.
willmiao/ComfyUI-Lora-Manager
ComfyUI용 포괄적인 관리 도구로, LoRA 모델과 체크포인트의 정리, CivitAI에서의 다운로드 및 적용을 간편하게 처리합니다.