steipete/sag
Like the macOS say command, but with a modern voice.
해결하는 문제
sag는 고품질 AI 음성 제공업체를 사용하여 텍스트에서 음성을 생성하는 간단한 'Mac 스타일' 방식을 제공하는 명령줄 인터페이스(CLI) 도구입니다. 복잡한 API 호출이나 GUI 도구가 필요 없이 한 명령어로 오디오를 직접 스피커에 스트리밍하거나 파일로 저장할 수 있습니다.
작동 방식
이 도구는 두 가지 주요 텍스트-to-음성(TTS) 제공업체인 ElevenLabs와 60db를 래핑합니다. API 인증, 음성 선택, 오디오 재생을 처리합니다. 사용자는 macOS의 say 명령어처럼 텍스트를 직접 전달하거나, 특정 하위 명령어를 사용하여 음성과 설정을 관리할 수 있습니다.
대상 사용자
커스텀 API 통합 코드를 작성하지 않고도 터미널 워크플로우, 스크립트, 또는 AI 에이전트에 고품질 AI 음성을 통합하고자 하는 개발자, 시스템 관리자, 크리에이터를 위한 도구입니다.
주요 기능
- 제공업체 지원: 구성된 API 키에 따라 자동으로 제공업체를 선택하는 ElevenLabs 및 60db 지원
- 스트리밍 재생: 생성 중인 오디오를 실시간으로 스피커에 직접 스트리밍할 수 있는 기능
- 음성 탐색: 언어, 사용 사례, 레이블 기준으로 음성을 검색, 목록화, 필터링할 수 있는 내장 명령어
- 유연한 출력: 출력 파일 확장자에 따라 MP3, WAV, PCM 등 다양한 형식으로 오디오를 저장할 수 있음
- 세밀한 제어: 속도, 안정성, 유사도, 스타일, 지연 수준 등에 대한 플래그를 통해 음성 전달을 정교하게 조정 가능
- 모델 선택: v3(표현력 있는 연기용) 및 v2.5 Flash(초저지연)를 포함한 여러 ElevenLabs 모델에 접근 가능
"이 도구는 터미널에서 AI 음성을 쉽게 사용할 수 있게 해주어, 개발자와 크리에이터에게 큰 도움이 됩니다." — @dev_user
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트