harry0703/AudioNotes

快速提取音视频内容,整理成一份结构化的markdown笔记

解決的問題

AudioNotes 提供了一種私密、本地化的解決方案,將音訊與影片錄音轉換為結構化文字與智慧筆記。它無需將敏感的會議、訪談或講座資料傳送至雲端 AI 服務,確保隱私的同時,自動化完成轉錄與摘要流程。

如何運作

此工具透過結合專用模型在本機執行。使用 FunASR 進行語音辨識,並透過 Ollama 執行大型語言模型(如 qwen3.5:2b),將轉錄內容整理為 Markdown 筆記,並回答內容相關的後續問題。可透過 Docker 部署,或直接從原始碼執行。

適用對象

專為需要整理會議、訪談、課程或語音備忘錄,但要求高資料隱私性,且偏好在自有硬體上執行 AI 工具的個人使用者設計。

主要特色

  • 本地優先隱私:音訊、轉錄內容與筆記皆儲存在本機;預設不會將資料傳送給第三方 AI API。
  • 端對端工作流程:從瀏覽器端錄音與檔案上傳,到轉錄與結構化筆記生成,全程自動化處理。
  • 互動式問答:允許使用者針對上傳的音訊或影片內容提出具體問題。
  • 彈性部署:支援基於 CPU 的 Docker 環境,也支援搭載 NVIDIA 顯示卡的 Linux 使用者使用 GPU 加速設定。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案