harry0703/AudioNotes
快速提取音视频内容,整理成一份结构化的markdown笔记
何を解決するか
AudioNotes は、音声および動画記録を構造化されたテキストと知的なノートに変換するプライバシー重視のローカルソリューションを提供します。機密性の高い会議、面接、講義データをクラウドベースのAIサービスに送信する必要がなくなり、プライバシーを確保しながら、トランスクリプト作成と要約の自動化を実現します。
動作方法
このツールは、専用モデルの組み合わせを使用してローカルで実行されます。音声認識には FunASR を、トランスクリプトをMarkdownノートに整理し、コンテンツに関する追加質問に答えるには Ollama を使用し、大規模言語モデル(例:qwen3.5:2b)を実行します。Docker でデプロイするか、ソースコードから直接実行できます。
対象ユーザー
会議、面接、講義、ボイスメモの整理が必要だが、高いデータプライバシーを求める個人ユーザー向けに設計されています。AIツールを自前のハードウェア上で実行することを好む方にも適しています。
特徴
- ローカル最優先のプライバシー:音声、トランスクリプト、ノートはすべてローカルマシンに保存され、デフォルトでは第三者のAI APIにデータが送信されません。
- エンドツーエンドのワークフロー:ブラウザベースの録音やファイルアップロードからトランスクリプト生成、構造化されたノート作成までを一貫して処理します。
- インタラクティブなQ&A:アップロードした音声や動画の内容について、具体的な質問を投げかけることができます。
- 柔軟なデプロイ:CPUベースのDocker環境と、NVIDIAカードを搭載したLinuxユーザー向けのGPU加速構成の両方をサポートしています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト