chubbyguan/chubbyskills
把中文全渠道内容(抖音 / B站 / 小红书 / 公众号 / X / 播客)采集进个人知识库的 13 个 AI Skill:图文存图、视频转文字稿、字幕优先免 GPU,附带知识库 MCP server。 | Ingest Chinese content into your personal knowledge base — image/video routing, subtitle-first transcription, and a KB MCP server.
何を解決するか
Chubby Skills は、中国語および世界的なソーシャルプラットフォームからのコンテンツ消費の分散化を解決し、さまざまなプラットフォームから情報を収集・整理・検索する統合パイプラインを提供します。一時的なソーシャルメディアフィードを構造化されたローカル知識ベースに変換し、AIエージェントが直接照会・利用できる形にすることで、貴重な情報が『フィード』の中に消えてしまうのを防ぎ、再利用可能な知識資産へと変換します。
動作方法
このプロジェクトは3つの異なるレイヤーで構成されています:
- 収集レイヤー:Bilibili、YouTube、TikTok、Douyin、X(Twitter)、WeChat公式アカウント、ポッドキャストなど、複数のプラットフォームからコンテンツをスクレイピング・音声認識し、詳細なメタデータ(Schema v1)を含む標準化されたMarkdown形式に変換する専用「スキル」を使用します。
- 知識レイヤー:これらのMarkdownファイルをローカルのボルト(例:Obsidian)に統合し、軽量なローカル埋め込みまたはOpenAIなどのプロバイダーを用いたインデックス作成、全文検索、意味的検索機能を提供します。
- エージェントレイヤー:AIエージェント(例:Claude CodeやCodex)がローカル知識ベースを検索・読み取り・操作できるようにするMCP(Model Context Protocol)サーバーを実装しています。ユーザーが収集したデータに基づいてタスクを完了します。
対象ユーザー
- コンテンツクリエイター:話題のノート、動画、記事をリポジトリとして構築し、トピック調査に活用。
- 学習者:動画や音声コンテンツをテキスト、フラッシュカード、構造化されたノートに変換。
- 研究者:ローカルでアクセス可能なエージェント対応のリファレンスライブラリを維持。
- エージェントユーザー:コンテンツ収集とAI検索を組み合わせた自動ワークフローを構築。
特徴
- マルチプラットフォーム対応:Bilibili、YouTube、X、WeChatなどを含む10以上のプラットフォームを網羅。
- ローカル最優先のプライバシー:完全にローカルでの実行と保存により、データのプライバシーを確保。
- 音声認識機能:FunASRやFaster-Whisperなどのツールを用いた動画・ポッドキャストの音声認識を内蔵。
- エージェント統合:個人の知識にシームレスにアクセスできる完全なMCPサーバー実装。
- コンテンツ強化:DeepSeek APIを活用したAIによる要約、タグ付け、価値判断のオプション機能。
- 標準化出力:一貫性のあるデータのポータビリティを確保する厳格なMarkdownフロントマターとスキーマ。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト