Kabanosk/whisper-website
Simple self-hosted web application, which can be used to convert audio to subtitles by OpenAI's Whisper model
해결하는 문제
클라우드 서비스에 의존하지 않고, 사용자의 자체 머신에서 완전히 트랜스크립션과 번역이 이루어지는 간단한 자체 호스팅 인터페이스를 제공하여, 오디오 파일을 텍스트 및 자막으로 변환할 수 있도록 합니다.
작동 방식
이 애플리케이션은 OpenAI의 Whisper 모델을 웹 기반 래퍼로 사용합니다. 사용자는 브라우저를 통해 오디오 파일을 업로드하고, tiny에서 large까지 다양한 Whisper 모델 크기를 선택하여 오디오를 처리하고 트랜스크립트를 생성합니다.
대상 사용자
클라우드 기반의 음성 인식 서비스 대신 개인적이고 로컬한 대안을 원하는, 오디오 파일에서 자막이나 텍스트 트랜스크립트를 생성하고자 하는 사용자들입니다.
주요 기능
- 로컬 처리: 클라우드 의존 없이 모든 작업이 사용자의 컴퓨터에서 수행됩니다.
- 다양한 내보내기 형식:
.srt,.vtt, 그리고 일반적인.txt파일을 지원합니다. - 모델 유연성: 정확도와 속도의 균형을 맞출 수 있는 다양한 Whisper 모델 크기를 선택할 수 있습니다.
- 번역 기능: 트랜스크립트를 다른 언어로 번역하는 선택적 기능을 포함합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트