lycohana/BiliSum
为 Bilibili、YouTube 及本地视频提供 AI 视频摘要和知识库.AI video summarizer and knowledge base for Bilibili, YouTube and local videos.
它解决了什么问题
BiliSum 解决了从长视频内容中提取和整理知识的难题。它能自动将 Bilibili、YouTube 或本地视频文件转换为结构化文本、视觉笔记和可搜索的知识库,无需手动转录和记笔记。
它如何工作
该工具采用流水线方式:导入视频内容,使用 ASR(自动语音识别)进行转录,然后利用 LLM 和 VLM(视觉语言模型)生成摘要、结构化笔记和思维导图。它能提取关键帧,创建 "VLM 可理解" 的视觉笔记,将图像根据视觉上下文整合到文本中。对于长期存储,它使用嵌入(embeddings)构建本地 RAG(检索增强生成)系统,实现跨多个视频的语义搜索和问答功能。
适合谁使用
专为学生、研究人员和终身学习者设计,他们观看教育或信息类视频内容,并希望将这些内容转化为永久且可搜索的个人知识库。
主要亮点
- 多模态笔记:通过结合转录文本与 AI 选择的视频截图,生成视觉笔记。
- 本地优先的隐私保护:数据、索引和配置均本地存储,支持本地 LLM 和嵌入模型。
- 灵活的输入方式:支持 Bilibili、YouTube 和本地视频格式(mp4、mkv、mov、webm)。
- 代理集成:提供 CLI 和特定 "技能",允许 AI 代理(如 Claude 或 Cursor)触发摘要和转录。
- 知识管理:具备基于 RAG 的知识库,支持跨视频语义检索和思维导图生成。
相关
- 项目
- 项目
- 项目
- 项目
- 项目