VocaHQ/vocalinux
Free, open-source, 100% offline voice dictation for Linux. Speak and type anywhere via whisper.cpp, Whisper & VOSK engines, GPU-accelerated, works on X11 + Wayland!
해결하는 문제
Vocalinux는 Linux 사용자를 위한 원활하고 프라이버시 중심의 음성-텍스트 변환 경험을 제공합니다. X11 또는 Wayland을 사용 중이든 관계없이, 어떤 애플리케이션에도 음성으로 텍스트를 입력할 수 있어, 네이티브 리눅스 음성 입력 기능의 공백을 메웁니다.
작동 방식
이 앱은 데스크톱 애플리케이션으로 실행되며, 오디오를 캡처하고 whisper.cpp(기본), OpenAI Whisper, 또는 VOSK 중 하나의 온디바이스 음성 인식 엔진을 사용해 텍스트로 변환합니다. 모든 AMD, Intel, NVIDIA 하드웨어에서 호환되는 Vulkan을 사용해 유니버설 GPU 가속을 제공합니다. 모델을 다운로드한 후에는 모든 처리가 사용자 기기에서 로컬로 이루어집니다. 변환된 텍스트는 IBus 또는 기타 인젝션 방법을 통해 활성 애플리케이션에 삽입됩니다.
대상 사용자
Ubuntu, Debian, Fedora, Arch 등 다양한 배포판에서 작동하는 고성능, 프라이버시 보장, 시스템 전반에 걸친 음성 입력 도구를 원하는 리눅스 데스크톱 사용자.
주요 특징
- 온디바이스 처리: 초기 모델 다운로드 이후 음성-텍스트 변환은 모두 로컬에서 이루어져 최대한의 프라이버시를 보장합니다.
- 유연한 엔진 선택: 고성능을 원하는 사용자를 위해 whisper.cpp, PyTorch 사용자를 위한 OpenAI Whisper, 저메모리 환경을 위한 VOSK를 지원합니다.
- 유니버설 리눅스 지원: 주요 배포판에서 X11 및 Wayland 모두 호환됩니다.
- 사용자 정의 활성화: 토글 모드와 푸시투톡 모드를 제공하며, 사용자 정의 키보드 단축키를 설정할 수 있습니다.
- GPU 가속: Vulkan을 활용해 광범위한 하드웨어 호환성을 제공합니다.
- 신경망 기반 VAD: Silero 음성 활성 감지 기능을 내장해 녹음 정확도를 향상시킵니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트