ChenShuo2004/cs-board

将参考声音和中文文案自动生成白板动画视频的本地 AI 工具。

📽️ cs‑board – 로컬 AI 화이트보드 동영상 제작 워크스테이션

한 줄 요약

중국어 텍스트, 참조 오디오, 선택적 스타일/캐릭터 이미지를 입력하면, 자동으로 음성 합성, 일러스트, 손그림 애니메이션, 자막, 음성-영상 동기화가 된 MP4 화이트보드 애니메이션으로 변환합니다.


🎯 핵심 위치

  • 로컬 실행 – 모든 오디오, 모델 호출, 생성된 자료는 로컬에 저장되어 개인정보 보안이 보장됩니다.
  • 엔드투엔드 파이프라인 – 음성 클론 → 텍스트 분할 → 일러스트 생성 → 손그림 애니메이션 → 자막/합성 → MP4 내보내기까지 완전 자동화.
  • 옵션 클라우드 서비스 – MiniMax H3, OpenLux 등 OpenAI 프로토콜 호환 API를 통해 텍스트 및 이미지 모델을 호출할 수 있으며, IndexTTS(Gradio/FastAPI)를 자체 배포하여 로컬 음성 클론도 가능합니다.
  • 로컬 네트워크 협업 – 여러 대의 컴퓨터가 동일한 제작 큐를 공유하여, 동일한 네트워크 내에서 팀워크가 가능합니다.

🛠️ 주요 기능

기능 설명
로컬 음성 클론 자체 구축한 IndexTTS 서비스에 연결하여 참조 오디오가 로컬에 머무르며, 인물/브랜드 전용 음성 합성 가능.
12가지 시각 템플릿 극소형 화이트보드에서 사이버 네온, 국풍 캐릭터, 3D 클레이까지 다양한 스타일로, 각 템플릿은 색상, 선 스타일, 구성 제안을 포함.
사용자 정의 캐릭터/스타일 최대 5명의 캐릭터를 등록 가능. 각 캐릭터에 1~3장의 참조 이미지 또는 1장의 전체 스타일 이미지를 업로드하여, 전체 영상에서 일관된 스타일 유지.
동적 인포그래픽 내레이션의 실제 타임라인에 따라 문장별로 지식 카드가 순차적으로 등장하게 하여, 화면이 내레이션을 앞서는 것을 방지.
중국어 핵심어 오버레이 로컬에서 4~10자 중국어 핵심 구절을 렌더링하여 일반적인 중국어 깨짐 문제를 피할 수 있으며, 언제든지 비활성화 가능.
가변 리듬 제어 자막 표시 여부, 선 굵기 조절, 4단계의 그리기 양 선택, 한 장의 이미지에 1~4개의 장면 포함 가능하여 영상 리듬을 유연하게 조절.
작업 재사용/복원 음성, 장면 분할, 이미지, 영상 세그먼트에 체크포인트를 설정하여, 로컬 렌더링 설정을 수정해도 모델 재호출 필요 없음.
로컬 네트워크 협업 동일한 로컬 네트워크 내의 기기들이 공유 큐, 진행 상황, 이력 기록을 확인 가능하며, 개인 설정은 각 브라우저에 저장됨.

🚀 빠르게 시작하기 (5분 내 완료)

  1. 환경 준비 – Windows 10/11, macOS 15+, Python 3.11+, Node 22.13+, PATH에 FFmpeg/FFprobe 설치. IndexTTS 2.5 서비스에 접근 가능하고 OpenLux API Key(텍스트+이미지 모델 권한) 필요.
  2. 설치 (macOS 예시)
    brew install python@3.13 node ffmpeg
    python3.13 scripts/prepare_env.py
    .venv/bin/python -m pip install -r webapp/requirements.txt
    (cd web && npm ci)
    
  3. 시작
    ./start-webapp.sh   # Windows는 start-webapp.ps1 사용
    
    브라우저가 자동으로 http://127.0.0.1:13000/ 열림.
  4. API 설정 – 오른쪽 상단의 API 설정에 OpenLux API Key, 텍스트 모델(기본 gpt-5), 이미지 모델(기본 gpt-image-2), IndexTTS 주소 입력. Test 클릭으로 연결 확인.
  5. 동영상 생성 – 10~30초의 참조 오디오 업로드, 중국어 텍스트 붙여넣기, 제작 모드(표준/사용자 정의/동적 인포그래픽)와 시각 템플릿 선택 후 시작 클릭.

📚 적용 시나리오

모드 추천 사용 상황
표준 제작 지식 설명, 스토리 내레이션, 강의 홍보 – 자동 장면 분할, 일러스트 생성, 화이트보드 애니메이션 생성.
사용자 정의 참조 브랜드 영상, 고정 IP, 시리즈 콘텐츠 – 스타일 이미지 및 캐릭터 참조 업로드로 일관된 캐릭터와 스타일 유지.
동적 인포그래픽 비즈니스 분석, 의견 표현, 강의 콘텐츠 – 내레이션과 동기화된 동적 카드로 시청자가 "듣는 동시에 이해"할 수 있도록 지원.

📁 프로젝트 구조 개요

assets/          # 펜, 템플릿 자료
docs/            # 동적 인포그래픽 워크플로 문서
examples/        # 예시 GIF/비디오
scripts/         # 렌더링, 타임라인, 유지보수 스크립트
tests/           # 단위/통합 테스트
video_renderer/  # Remotion(React 기반) 비디오 렌더러
web/             # React 프론트엔드
webapp/          # FastAPI 백엔드
start‑webapp.*   # 1클릭 시작 스크립트(Windows/Unix)

🧪 개발/테스트 가이드

  • 프론트엔드: (cd web && npm test)
  • 백엔드 작업 큐 및 체크포인트 복원: python -m unittest discover -s tests -v
  • Remotion 타입 검사: (cd video_renderer && npm run build)

🤝 기여 및 라이선스

  • 기여 – Issue 또는 Pull Request 제출. 렌더링 로직 변경 시 실제 자료 기반의 타이밍, 마스크, 완성 영상 검증을 함께 제출해 주세요.
  • 라이선스 – MIT License.

📢 후원사

MiniMax H3 동영상 생성 API(미니맥스 테크놀로지)는 저렴한 768p/2K 동영상 생성을 제공하며 OpenAI 프로토콜 호환 및 ComfyUI 지원. 전용 링크 사용 시 할당량 제공.


결론적으로:cs-board는 "텍스트 + 음성"을 "손그림 화이트보드 애니메이션"으로 변환하는 종단 간 도구로, 개인 크리에이터와 소규모 팀이 로컬에서 고품질 중국어 영상을 빠르게 제작할 수 있으며, 사용자 정의 스타일과 로컬 네트워크 협업을 지원합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트