jamsch/expo-speech-recognition

Speech Recognition for React Native Expo projects

해결하는 문제

expo-speech-recognition는 React Native 프로젝트에서 음성 인식 기능을 구현하기 위한 통합 API를 제공합니다. iOS, Android, Web 간에 분산된 네이티브 음성 인식 API 문제를 해결하여, 하나의 코드베이스로 세 플랫폼 모두에서 작동하는 애플리케이션을 개발할 수 있게 합니다.

작동 방식

이 라이브러리는 각 플랫폼의 네이티브 음성 인식 서비스를 래핑합니다:

  • iOS: SFSpeechRecognizer 사용.
  • Android: SpeechRecognizer 사용.
  • Web: SpeechRecognition API 사용.

useSpeechRecognitionEvent와 같은 훅과 ExpoSpeechRecognitionModule이라는 직접 모듈 API를 제공하여 음성 인식 세션을 시작, 중지, 관리할 수 있습니다. 권한 처리, 이벤트 기반 결과(임시 및 최종), 온디바이스 인식 및 오디오 세션 카테고리와 같은 플랫폼별 설정을 모두 처리합니다.

대상 사용자

플랫폼별 네이티브 코드를 작성하지 않고도 모바일 및 웹 애플리케이션에 음성 입력 또는 음성 변환 서비스를 통합하고자 하는 React Native 및 Expo 개발자.

주요 기능

  • 크로스플랫폼 지원: iOS, Android, Web에 대한 통일된 인터페이스.
  • 유연한 변환: 실시간(임시) 결과와 최종 변환 모두 지원.
  • 오디오 지속성: Android 13+ 및 iOS에서 로컬 파일에 오디오 녹음을 저장 가능.
  • 파일 기반 변환: 로컬 URI에서 기존 오디오 파일을 변환 가능.
  • 고급 제어: 볼륨 메터링, 언어 감지(안드로이드 14+), 네트워크를 통한 오디오 전송을 방지하기 위해 온디바이스 인식을 강제할 수 있음.
  • 사용자 정의: 특정 앱 관련 용어의 인식 정확도를 높이기 위해 컨텍스트 문자열을 제공할 수 있음.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트