aqm857886159/Nomi

Open-source, local-first desktop app for AI video creation: write a script → generate images & video → edit on a timeline → export. Bring your own model & API key — everything runs on your machine. Built with Electron + React.

해결하는 문제

Nomi는 시각적 의도를 AI 생성기에 정확하게 전달하는 것의 어려움을 해결합니다. 텍스트 프롬프트에만 의존하여 모델이 "추측"하게 하는 대신, 3D 스테이징과 구조화된 워크플로우를 통해 구도, 캐릭터 정체성 및 카메라 움직임을 제어할 수 있는 전문적인 디렉터 워크스페이스를 제공합니다.

작동 방식

Nomi는 전체 제작 파이프라인을 단일 로컬 퍼스트 애플리케이션으로 통합합니다:

  1. 스크립트 작성 및 스토리보드: 사용자가 스토리를 작성하면 AI가 이를 상세한 샷 리스트(샷, 캐릭터 및 프롬프트)로 분해합니다.
  2. 3D 디렉터 스테이지: 사용자는 3D 마네킹의 포즈를 취하고, 카메라 각도를 설정하며, 프레임을 정의하여 샷 간의 공간적 관계를 고정하는 시각적 참조를 생성할 수 있습니다.
  3. 캔버스 생성: 이미지와 비디오가 캔버스에서 병렬로 생성되며, 사용자는 앱 내 편집(배경 제거, 요소 조정)을 수행하고 노드 간에 에셋을 재사용할 수 있습니다.
  4. 타임라인 편집: 생성된 클립을 타임라인으로 드래그하여 최종 조립 및 MP4로 내보내기를 수행합니다.
  5. 모델 통합: API 키 또는 공식 CLI 통합(예: Jimeng)을 통해 다양한 이미지 및 비디오 모델(예: Sora 2, Veo 3.1, Kling, Wan)에 연결됩니다.

대상 사용자

시각적 결과물에 대해 세밀한 제어가 필요하고, 여러 웹 도구를 전환하지 않고 스크립트부터 최종 비디오까지 프로세스를 관리할 수 있는 통합된 워크스페이스를 원하는 AI 크리에이터, 디렉터 및 스토리보드 아티스트를 위해 설계되었습니다.

주요 특징

  • 3D 컴포지션 제어: 3D 스테이지를 사용하여 샷을 "구축"함으로써 일관된 프레이밍과 포즈를 보장합니다.
  • 캐릭터 일관성: 프로젝트 수준의 에셋 잠금을 통해 서로 다른 클립 간의 "얼굴 변형(face drift)"을 방지합니다.
  • 통합 파이프라인: 스크립트 $ ightarrow$ 스토리보드 $ ightarrow$ 캔버스 $ ightarrow$ 타임라인 $ ightarrow$ 내보내기로 이어지는 원활한 흐름.
  • Headless Capability Core: Claude Code 또는 Cursor와 같은 프로그래밍 어시스턴트가 대화를 통해 Nomi를 제어할 수 있도록 하는 MCP (Model Context Protocol) 구현.
  • 로컬 퍼스트: 프로젝트와 에셋은 사용자의 로컬 머신에 저장됩니다.