lycohana/BiliSum

为 Bilibili、YouTube 及本地视频提供 AI 视频摘要和知识库.AI video summarizer and knowledge base for Bilibili, YouTube and local videos.

它解决了什么问题

BiliSum 解决了从长视频内容中提取和整理知识的难题。它能自动将 Bilibili、YouTube 或本地视频文件转换为结构化文本、视觉笔记和可搜索的知识库,无需手动转录和记笔记。

它如何工作

该工具采用流水线方式:导入视频内容,使用 ASR(自动语音识别)进行转录,然后利用 LLM 和 VLM(视觉语言模型)生成摘要、结构化笔记和思维导图。它能提取关键帧,创建 "VLM 可理解" 的视觉笔记,将图像根据视觉上下文整合到文本中。对于长期存储,它使用嵌入(embeddings)构建本地 RAG(检索增强生成)系统,实现跨多个视频的语义搜索和问答功能。

适合谁使用

专为学生、研究人员和终身学习者设计,他们观看教育或信息类视频内容,并希望将这些内容转化为永久且可搜索的个人知识库。

主要亮点

  • 多模态笔记:通过结合转录文本与 AI 选择的视频截图,生成视觉笔记。
  • 本地优先的隐私保护:数据、索引和配置均本地存储,支持本地 LLM 和嵌入模型。
  • 灵活的输入方式:支持 Bilibili、YouTube 和本地视频格式(mp4、mkv、mov、webm)。
  • 代理集成:提供 CLI 和特定 "技能",允许 AI 代理(如 Claude 或 Cursor)触发摘要和转录。
  • 知识管理:具备基于 RAG 的知识库,支持跨视频语义检索和思维导图生成。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目