IliasHad/edit-mind

Local-first Video Knowledge Base. Index your video library with multi-modal analysis (YOLO, DeepFace, Whisper), search semantically via natural language, Docker-ready.

What it solves

Edit Mind는 로컬 AI 기반 비디오 라이브러리용 지식 베이스를 만듭니다. 수시간에 걸친 영상을 수동으로 뒤져 특정 순간을 찾을 필요 없이, 자연어로 말한 단어, 객체, 얼굴 또는 특정 장면을 검색할 수 있습니다.

How it works

시스템은 백그라운드 서비스로 실행되어 비디오 폴더를 모니터링합니다. 비디오 콘텐츠를 분석하기 위해 여러 AI 모델을 결합합니다:

  • Transcription: OpenAI Whisper를 사용해 음성을 텍스트로 변환합니다.
  • Visual Analysis: 얼굴 인식, 객체 탐지, 텍스트 탐지를 수행합니다.
  • Semantic Search: 멀티 모델 임베딩과 ChromaDB(벡터 데이터베이스)를 활용해 인덱싱된 메타데이터에 대한 자연어 질의를 가능하게 합니다.
  • LLM Integration: Ollama 로컬 모델 또는 Google Gemini 클라우드 모델을 지원해 NLP 작업을 수행합니다.

Who it’s for

대용량 로컬 비디오 아카이브에서 특정 클립을 조직하고 검색해야 하는 영상 편집자와 콘텐츠 제작자를 위한 "두 번째 뇌" 역할을 합니다. 프라이버시도 유지됩니다.

Highlights

  • Fully Local: Docker를 통해 자체 하드웨어에서 실행되어 비디오가 외부에 노출되지 않도록 합니다.
  • Cuda Support: NVIDIA GPU 가속을 위한 특정 설정을 포함합니다.
  • Multi-Model Indexing: 전사, 프레임 분석, 임베딩을 결합해 포괄적인 검색을 제공합니다.
  • Broad Compatibility: Docker가 설치된 모든 컴퓨터나 서버에서 작동합니다.