nikdanilov/whisper-obsidian-plugin
Speech-to-text in Obsidian using Whisper
What it solves
이 플러그인은 Obsidian 사용자가 노트 내에서 직접 음성을 텍스트로 변환할 수 있게 해줍니다. 전사(transcription) 기능과 선택적인 AI 기반 사후 처리 기능을 워크플로우에 통합함으로써, 오디오 파일을 수동으로 전사하거나 외부 도구를 사용할 필요를 없애줍니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
openai/whisperWhisper는 OpenAI의 오픈 소스 트랜스포머 기반 음성-텍스트 변환 시스템으로, 다양한 언어에 대해 전사, 언어 식별 및 번역을 처리합니다. 6가지 모델 크기(tiny → large, 그리고 빠른 "turbo" 변체)를 갖춘 pip 설치 가능 패키지로 제공됩니다. CLI (`whisper …`)와 간단한 Python API (`whisper.load_model(...).transcribe(...)`)를 사용하면 몇 가지 명령만으로 오디오 파일을 텍스트로 변환할 수 있습니다. 이 프로젝트는 Python 3.8-3.11, PyTorch에서 실행되며 ffmpeg(및 선택적으로 토크나이저용 Rust)가 필요합니다. 모든 코드와 모델 가중치는 MIT 라이선스입니다.