Stonewuu/ai-fusion-video

【融光】 - 基于 Agent 的全流程AI短剧/漫剧/视频创作平台 - Java & agentscope2.0 | Agent-based end-to-end AI creation platform for short dramas, motion comics, and videos – built on Java & & agentscope 2.0.

해결하는 문제

Ai-fusion-video (융광)는 동영상 제작자들의 전체 제작 프로세스를 간소화하기 위해 설계된 에이전트 기반 동영상 제작 플랫폼입니다. 스크립트 작성, 스토리보드 작성, 자산 관리, AI 기반 이미지 및 동영상 생성을 하나의 통합된 작업 공간에 통합함으로써 도구의 분산 문제를 해결합니다.

작동 방식

이 플랫폼은 프로젝트, 에피소드, 장면이라는 구조적 계층으로 창작 과정을 정리합니다. AgentScope를 기반으로 한 에이전트 워크스페이스를 활용하여, 창작자는 스트리밍 대화와 멀티모달 입력(이미지, 동영상, 오디오, 파일)을 통해 AI와 상호작용할 수 있습니다.

주요 기술 구성 요소는 다음과 같습니다:

  • 에이전트 워크플로우: 스킬, MCP(Model Context Protocol), 서브에이전트를 지원하여 복잡한 다단계 창작 작업을 처리합니다.
  • 모델 통합: OpenAI, Anthropic, Gemini, DashScope, Ollama 등의 다양한 LLM과 전용 이미지/동영상 생성 서비스를 API를 통해 연결합니다.
  • 자산 파이프라인: 로컬 저장소 또는 S3 호환 객체 저장소를 사용하여 미디어 자산을 관리하고, FFmpeg 및 FFprobe를 활용해 동영상 처리를 수행합니다.
  • 풀스택 아키텍처: Java 21/Spring Boot 백엔드와 Next.js 16 프론트엔드로 구축되었습니다.

대상 사용자

초기 스크립트부터 최종 시각 자산까지 AI를 활용해 워크플로우를 가속화하고자 하는 동영상 제작자 및 제작 팀에게 적합합니다.

주요 특징

  • 통합 워크스페이스: 스크립트 작성, 스토리보드 작성, 자산 생성을 한 곳에서 수행합니다.
  • 에이전트 기반: 멀티모달 컨텍스트와 도구 호출 기능을 갖춘 고도화된 에이전트 워크스페이스를 제공합니다.
  • 유연한 모델 지원: 하드코딩된 키 없이 다양한 텍스트, 이미지, 동영상 모델을 지원합니다.
  • 엔터프라이즈 대응 배포: Docker Compose 구성 제공으로 간편한 설정이 가능하며, 프론트엔드와 백엔드를 별도로 배포하는 것도 지원합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트