harry0703/AudioNotes
快速提取音视频内容,整理成一份结构化的markdown笔记
解决的问题
AudioNotes 提供了一种私密、本地化的解决方案,将音频和视频录音转换为结构化文本和智能笔记。它无需将敏感的会议、访谈或讲座数据发送到基于云的AI服务,从而在确保隐私的同时,自动化完成转录和摘要过程。
如何工作
该工具通过结合专用模型在本地运行。它使用 FunASR 进行语音识别,使用 Ollama 运行大型语言模型(如 qwen3.5:2b)将转录内容整理为 Markdown 笔记,并回答关于内容的后续问题。可通过 Docker 部署,也可直接从源代码运行。
适用人群
专为需要整理会议、访谈、课程或语音备忘录,但要求高数据隐私性,并倾向于在自有硬件上运行 AI 工具的个人用户设计。
主要亮点
- 本地优先隐私:音频、转录文本和笔记均存储在本地设备上;默认情况下,不会将数据发送给第三方 AI API。
- 端到端工作流:从浏览器端录音和文件上传,到转录和结构化笔记生成,全程自动化处理。
- 交互式问答:允许用户针对上传的音频或视频内容提出具体问题。
- 灵活部署:支持基于 CPU 的 Docker 部署,也支持配备 NVIDIA 显卡的 Linux 用户使用 GPU 加速配置。
相关
- 项目
- 项目
- 项目
- 项目
- 项目