joeseesun/qiaomu-cut-skill

乔木智能视频导演 Skill:素材治理、双语字幕、品牌包装与可复现渲染 | Agent-native video director with governed sourcing and verifiable rendering

해결하는 문제

qiaomu-cut은 간단한 텍스트 프롬프트를 완전하고 재현 가능한 비디오 프로젝트로 변환합니다. 스톡 영상 검색, 저작권 관리, ffmpeg 설정, 자막 작성, 전환 효과 조정과 같은 수작업을 제거하여 전문가 수준의 비디오 제작 과정을 AI 에이전트가 실행하고 검증할 수 있는 엔지니어링 워크플로우로 전환합니다.

작동 방식

이 시스템은 구조화된 접근 방식을 사용하는 '에이전트 네이티브 비디오 디렉터'로 작동합니다:

  1. 계획: 사용자 요청을 QiaoCut IR(중간 표현)로 변환하여 재생 시간, 비율, 촬영 목록, 자산 전략을 정의합니다.
  2. 자산 확보: 다양한 엔진에 요청을 라우팅합니다: ClipSeek/Pexels/Pixabay는 스톡 영상, 33tc는 영화 대사, ListenHub/MarsWave는 AI 생성 이미지, 비디오, TTS, 음악, 로컬 파일을 활용합니다.
  3. 디자인: J/L 컷, 푸시-풀-팬 움직임, 삼중 레이어 이중 언어 ASS 자막과 같은 전문적인 시네마틱 기법을 적용합니다.
  4. 렌더링: ffmpeg-full을 사용해 최종 제품을 합성하며, 세 가지 성능 프로파일을 제공합니다: preview(빠름, 저해상도), standard(균형), final(고품질, 완전 검증).
  5. 검증: 렌더링 보고서와 컨택트 시트를 생성하여 기술적 품질과 라이선스 출처를 보장합니다.

대상 사용자

스톡 영상 수동 관리나 복잡한 비디오 편집 파이프라인을 피하고 싶은 콘텐츠 크리에이터, 교육자, AI 에이전트. 영어 학습 영상, 제품 출시 영상, 시네마틱 스토리, 데이터 스토리텔링 등 고품질의 단편 영상을 생성해야 하는 경우에 적합합니다.

주요 특징

  • 다중 엔진 라우팅: ListenHub, ClipSeek, 33tc 등 다양한 AI 및 스톡 자산 제공업체를 단일 워크플로우에 통합합니다.
  • 전문적인 타이포그래피: 모바일 안전 영역과 플랫폼별 폰트 처리를 지원하는 삼중 레이어 이중 언어 자막을 지원합니다.
  • 결정론적 렌더링: 재현 가능한 IR 형식을 사용해 동일한 프로젝트를 환경에 관계없이 일관되게 렌더링할 수 있습니다.
  • 계층적 워크플로우: previewstandardfinal 파이프라인을 제공하여 반복 속도를 높이고 렌더링 비용을 줄입니다.
  • 증거 기반 프로바넌스: 자산 매니페스트와 라이선스 보고서를 자동 생성하여 사용된 각 클립의 출처와 권리를 추적합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트