chubbyguan/chubbyskills
把中文全渠道内容(抖音 / B站 / 小红书 / 公众号 / X / 播客)采集进个人知识库的 13 个 AI Skill:图文存图、视频转文字稿、字幕优先免 GPU,附带知识库 MCP server。 | Ingest Chinese content into your personal knowledge base — image/video routing, subtitle-first transcription, and a KB MCP server.
解决的问题
Chubby Skills 通过提供统一的管道,解决内容消费碎片化的问题,能够从多种中文及全球社交平台中捕获、组织和检索信息。它将短暂的社交媒体动态转化为结构化的本地知识库,可直接由 AI Agent 查询和使用,防止有价值的信息在“信息流”中丢失,并将其转化为可重复利用的知识资产。
如何工作
该项目分为三个独立的层级:
- 采集层:使用专用的“技能”从 Bilibili、YouTube、TikTok、Douyin、X(Twitter)、WeChat 公众号、播客等平台抓取并转录内容,转换为带有详细元数据(Schema v1)的标准 Markdown 格式。
- 知识层:将这些 Markdown 文件整合到本地知识库(如 Obsidian)中,通过轻量级本地嵌入或 OpenAI 等提供方,实现索引、全文搜索和语义检索功能。
- Agent 层:实现 MCP(Model Context Protocol)服务器,使 AI Agent(如 Claude Code 或 Codex)能够搜索、读取并交互本地知识库,基于用户捕获的数据完成任务。
适用人群
- 内容创作者:构建病毒式笔记、视频和文章的仓库,用于主题研究。
- 学习者:将视频和音频内容转化为文本、闪卡和结构化笔记。
- 研究者:维护一个本地、可被 Agent 访问的参考文献库。
- Agent 用户:构建结合内容采集与 AI 检索的自动化工作流。
核心亮点
- 多平台支持:全面覆盖 Bilibili、YouTube、X、WeChat 等 10+ 平台。
- 本地优先隐私保障:完全本地执行与存储,确保数据隐私。
- 内置转录能力:支持使用 FunASR 和 Faster-Whisper 等工具对视频和播客进行转录。
- Agent 集成:完整实现 MCP 服务器,实现 AI Agent 对个人知识的无缝访问。
- 内容增强:通过 DeepSeek API 可选地实现 AI 驱动的摘要、标签和价值判断。
- 标准化输出:严格遵循 Markdown 前置元数据和 Schema,确保数据可移植性。
相关
- 项目
- 项目
- 项目
- 项目
- 项目