chidiwilliams/buzz
Buzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.
해결하는 문제
Buzz는 개인 컴퓨터에서 온라인 서비스 없이 오디오 및 비디오 파일의 음성 인식과 번역을 가능하게 하며, 클라우드 기반 서비스에 의존할 필요를 제거합니다. 또한 라이브 이벤트 및 발표회용 실시간 음성 인식도 지원합니다.
작동 방식
OpenAI의 Whisper 모델을 기반으로 하며, Nvidia GPU용 CUDA, Mac용 Apple Silicon, 다양한 GPU용 Vulkan 등 여러 하드웨어 가속 백엔드를 지원합니다. 로컬 파일, YouTube 링크, 또는 실시간 마이크 입력을 처리할 수 있으며, 소음이 많은 환경에서 정확도를 높이기 위해 음성 분리 기능도 제공합니다.
대상 사용자
개인 정보 보호를 중시하는 오프라인 음성 인식 및 번역이 필요한 사용자, 그리고 청중을 위해 실시간 자막이 필요한 발표자에게 적합합니다.
주요 기능
- 다양한 입력 지원: 오디오/비디오 파일, YouTube 링크, 실시간 마이크 입력을 모두 지원합니다.
- 하드웨어 최적화: Nvidia, Apple Silicon, Vulkan 호환 GPU용 가속 기능 제공.
- 고급 도구: 스피커 식별, 음성 분리, 재생 컨트롤이 있는 전사 보기 기능 포함.
- 자동화: 자동 처리를 위한 워치 폴더와 스크립팅을 위한 CLI 제공.
- 확장성: AI 요약 생성 등의 작업을 위한 플러그인 시스템 탑재.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트