kaixxx/noScribe

Cutting edge AI technology for automated audio transcription. A nice GUI for OpenAIs Whisper and pyannote (speaker identification)

解消される課題

noScribeは、インタビューの高品質な音声文字起こしを作成するための、無料のオープンソースツールを提供します。これは特に質的研究やジャーナリズム向けに設計されています。ユーザーのコンピュータ上で完全にローカルに動作することで、クラウドベースの文字起こしサービスに関連するプライバシーの懸念という問題を解決します。

仕組み

このアプリケーションは、音声からテキストへの変換(speech-to-text)および話者識別(speaker identification)のために、既存のAIモデルを活用しています。OpenAIのWhisper、faster-whisper、およびpyannote-audioを統合し、約60言語にわたって文字起こしを行い、異なる話者を区別します。

対象ユーザー

主に質的研究者、ジャーナリスト、および話者識別機能を備えた安全なローカル音声文字起こしを必要とするすべての人を対象としています。

ハイライト

  • 機密性を最大限に高めるためのローカル処理
  • 異なる声を区別するための話者ダイアリゼーション(Speaker diarization)
  • 文字起こしを確認・修正するための組み込みエディタ
  • Windows、MacOS、およびLinuxに対応するクロスプラットフォームサポート
  • 約60言語のサポート

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト