lycohana/BiliSum

为 Bilibili、YouTube 及本地视频提供 AI 视频摘要和知识库.AI video summarizer and knowledge base for Bilibili, YouTube and local videos.

它解決的問題

BiliSum 解決了從長篇視頻內容中提取和整理知識的困難。它自動將 Bilibili、YouTube 或本地檔案的視頻轉換為結構化文字、視覺筆記和可搜尋的知識庫,無需手動轉錄或做筆記。

如何運作

該工具遵循一個流程:導入視頻內容,使用 ASR(自動語音辨識)進行轉錄,然後利用 LLM 和 VLM(視覺語言模型)生成摘要、結構化筆記和思維導圖。它能提取關鍵畫面,創建「VLM 可理解」的視覺筆記,將圖像根據視覺上下文整合到文字中。對於長期儲存,它使用嵌入(embeddings)建立本地的 RAG(檢索增強生成)系統,實現跨多個視頻的語義搜尋與問答。

適用對象

專為學生、研究人員和終身學習者設計,他們觀看教育或資訊性視頻內容,並希望將這些內容轉化為永久且可搜尋的個人知識庫。

主要特色

  • 多模態筆記:結合轉錄內容與 AI 選取的視頻截圖,生成視覺筆記。
  • 以本地為先的隱私保護:資料、索引和設定皆儲存在本地,支援本地 LLM 和嵌入模型。
  • 彈性輸入格式:支援 Bilibili、YouTube 及本地視頻格式(mp4、mkv、mov、webm)。
  • 代理整合:提供 CLI 和特定「技能」,讓 AI 代理(如 Claude 或 Cursor)可觸發摘要與轉錄。
  • 知識管理:具備基於 RAG 的知識庫,支援跨視頻語義檢索與思維導圖生成。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案