harry0703/AudioNotes

快速提取音视频内容,整理成一份结构化的markdown笔记

何を解決するか

AudioNotes は、音声および動画記録を構造化されたテキストと知的なノートに変換するプライバシー重視のローカルソリューションを提供します。機密性の高い会議、面接、講義データをクラウドベースのAIサービスに送信する必要がなくなり、プライバシーを確保しながら、トランスクリプト作成と要約の自動化を実現します。

動作方法

このツールは、専用モデルの組み合わせを使用してローカルで実行されます。音声認識には FunASR を、トランスクリプトをMarkdownノートに整理し、コンテンツに関する追加質問に答えるには Ollama を使用し、大規模言語モデル(例:qwen3.5:2b)を実行します。Docker でデプロイするか、ソースコードから直接実行できます。

対象ユーザー

会議、面接、講義、ボイスメモの整理が必要だが、高いデータプライバシーを求める個人ユーザー向けに設計されています。AIツールを自前のハードウェア上で実行することを好む方にも適しています。

特徴

  • ローカル最優先のプライバシー:音声、トランスクリプト、ノートはすべてローカルマシンに保存され、デフォルトでは第三者のAI APIにデータが送信されません。
  • エンドツーエンドのワークフロー:ブラウザベースの録音やファイルアップロードからトランスクリプト生成、構造化されたノート作成までを一貫して処理します。
  • インタラクティブなQ&A:アップロードした音声や動画の内容について、具体的な質問を投げかけることができます。
  • 柔軟なデプロイ:CPUベースのDocker環境と、NVIDIAカードを搭載したLinuxユーザー向けのGPU加速構成の両方をサポートしています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト