thewh1teagle/vibe
Transcribe on your own!
해결하는 문제
Vibe는 오디오 및 비디오 파일을 텍스트로 변환하는 사생활 보호가 되고 오프라인으로 작동하는 방법을 제공합니다. 모든 처리를 사용자 기기에서 로컬로 수행하므로 민감한 데이터를 클라우드 서비스에 업로드할 필요가 없습니다.
작동 방식
이 애플리케이션은 Whisper, Nemotron 3.5, Parakeet TDT v3와 같은 AI 모델을 사용하여 음성을 텍스트로 변환합니다. macOS, Windows, Linux에서 Nvidia, AMD, Intel GPU에 최적화되어 있습니다. 사용자는 로컬 파일, 시스템 오디오, 마이크 입력, 또는 YouTube 및 Vimeo와 같은 인기 있는 웹사이트의 오디오를 변환할 수 있습니다.
대상 사용자
개인정보를 우선시하는 고품질의 텍스트 변환 서비스가 필요한 누구나, 그리고 동영상 및 리얼용 자막이 필요한 콘텐츠 크리에이터에게 적합합니다.
주요 기능
- 오프라인 프라이버시: 완전히 로컬에서 변환되어 데이터가 기기 외부로 나가지 않습니다.
- 다국어 지원: 거의 모든 언어를 변환할 수 있으며, 오디오를 영어로 번역할 수도 있습니다.
- comodule: SRT, VTT, TXT, PDF 등 다양한 내보내기 형식을 지원합니다.
- AI 분석: Claude API 및 Ollama와 통합되어 로컬 AI 기반의 텍스트 요약 기능을 제공합니다.
- 유연한 입력: 배치 변환, 시스템 오디오, 마이크, 스마트폰 QR 코드를 통한 원격 녹음 지원.
- 개발자 도구: CLI와 HTTP API(스웨거 문서 포함)를 제공합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트