harry0703/AudioNotes
快速提取音视频内容,整理成一份结构化的markdown笔记
解決的問題
AudioNotes 提供了一種私密、本地化的解決方案,將音訊與影片錄音轉換為結構化文字與智慧筆記。它無需將敏感的會議、訪談或講座資料傳送至雲端 AI 服務,確保隱私的同時,自動化完成轉錄與摘要流程。
如何運作
此工具透過結合專用模型在本機執行。使用 FunASR 進行語音辨識,並透過 Ollama 執行大型語言模型(如 qwen3.5:2b),將轉錄內容整理為 Markdown 筆記,並回答內容相關的後續問題。可透過 Docker 部署,或直接從原始碼執行。
適用對象
專為需要整理會議、訪談、課程或語音備忘錄,但要求高資料隱私性,且偏好在自有硬體上執行 AI 工具的個人使用者設計。
主要特色
- 本地優先隱私:音訊、轉錄內容與筆記皆儲存在本機;預設不會將資料傳送給第三方 AI API。
- 端對端工作流程:從瀏覽器端錄音與檔案上傳,到轉錄與結構化筆記生成,全程自動化處理。
- 互動式問答:允許使用者針對上傳的音訊或影片內容提出具體問題。
- 彈性部署:支援基於 CPU 的 Docker 環境,也支援搭載 NVIDIA 顯示卡的 Linux 使用者使用 GPU 加速設定。
相關
- 專案
- 專案
- 專案
- 專案
- 專案