dmoshehun-prog/learn-from-materials

Turn PDFs, books and papers into interactive learning webpages|将复杂材料转化为可追溯、可测验、可做笔记的学习网页

learn-from-materials – ドキュメントを追跡可能でインタラクティブな学習ガイドに変換する

何ができるか

  • AIエージェントプラットフォーム(WorkBuddy、Claude Code、GitHub Copilot CLIなど)向けのスキル(プラグイン)で、ファイルの読み取りとPythonコードの実行が可能。
  • PDF、EPUB、MOBI、DOCX、PPTX、HTML、Markdown、TXT、RTF、またはこれらのファイルのコレクションといった、あらゆる種類の学習資料を入力として受け取り、以下の3つの成果物を生成する:
    1. .learnkb/ 知識ベース:すべての事実を正確な出典場所(ページ番号、スライド、章など)とともに記録。
    2. オフライン対応のインタラクティブHTMLページ:人間が資料を閲覧可能、用語集を検索、自己チェック問題を実行、出典の引用を確認できる。
    3. 同期されたMarkdown版:同じコンテンツのMarkdown形式。
  • 2種類の学習深度をサポート:
    • クイック概要 – 各出典付きの高レベルな要約。
    • 体系的学習 – より深く構造化された分解(コアフレームワーク、ガイド付きコンテンツ、用語集、行動ルール、動的自己チェック、ノート)。

なぜ重要か

  • 追跡可能性 – すべての記述が元のページ/スライドにリンクされ、検証や監査が容易。
  • オフライン優先 – すべての処理はローカルで実行;自動的なネットワーク呼び出しはなく、プライバシーを保護し、インターネット接続がなくても動作。
  • 最小権限設計 – スキルは資料への読み取りアクセスと出力先の場所のみが必要。ドキュメント内に埋め込まれた任意のコードは実行しない。
  • エージェント中心 – 開放的な Agent Skills 標準に基づいて構築されており、互換性のあるエージェントは単純なプロンプトで呼び出せる:
    请使用 learn-from-materials 对此PDF进行系统性学习,并生成可追溯的知识库和学习页面。
    

導入方法

  1. インストール – エージェントのスキルディレクトリにリポジトリをクローン(WorkBuddy、Codex、Claude Code、Copilot CLIの例を示す)。自動依存関係インストールは行わない。必要に応じて任意のツール(例:pdftotext、OCRmyPDF、Calibreのebook-convert)を手動で提供する必要がある。
  2. スキルの実行 – エージェントとのチャットで、クイック概要または体系的学習を依頼し、資料を添付。スキルはSKILL.mdに定義されたワークフローに従ってガイドする。
  3. コマンドラインユーティリティ – リポジトリには開発者向けスクリプトも含まれる:
    • scripts/extract.py – パース機能のテストとテキストの抽出。
    • scripts/verify_coverage.py – 生成された知識ベースが元資料を網羅しているかを監査。
    • scripts/render_page.py – JSONページ記述をHTMLまたはMarkdownに変換。
    • オプション:Playwright/Nodeによるレンダリングページの検証。

主な技術的詳細

  • パーススタック:可能な限りPython標準ライブラリを使用。オプションバックエンドにはPyPDF2/pdfminer.six(PDF用)、docling(技術的PDF用)、ebooklib(EPUB用)、python-docx(DOCX用)、striprtf(RTF用)、Calibreのebook-convert(MOBI/AZW用)。
  • OCRサポート:スキャンされたPDFの場合、OCRmyPDF + pdftotextを組み込むことができる。それ以外の場合は、影響を受けたセクションは未検証としてマークされる。
  • カバレッジと検証:抽出後、ソースハッシュ、インクリメンタル更新チェック、要約とソース間の双方向マッピング、逆方向のスポットチェックなどの一連の監査を実行し、知識ベースの正確性を保証。
  • 出力構造:生成された.learnkb/フォルダにはJSONページ(コアフレームワーク、用語集など)とHTMLテンプレートアセットが含まれる。インタラクティブページにはローカルストレージのみを使用する学習者プロファイルと、データをどこにも送信せずに間違った回答を記録する動的自己チェック機能が搭載されている。
  • セキュリティとプライバシー:すべての入力は信頼できないものとして扱われる。ソースドキュメント内のプロンプトやコマンドは実行されない。ZIPファイルはサニタイズされ、オプションのブラウザ検証ではdata:およびblob:URL以外のネットワークリクエストはブロックされる。

対象ユーザー

  • PDF、スライド、電子書籍が大量にある研究者、学生、プロフェッショナルで、クラウドサービスにコンテンツをアップロードせずに再現可能で出典に基づいた学習ガイドを必要とする人。
  • 「資料から学ぶ」機能を製品に追加するための即戦力スキルを必要とするAIエージェント開発者。
  • 特許情報や機密文書をデバイス上に保持しながら、LLMの推論を要約や自己テストに活用したいプライバシー意識の高いユーザー。

現在の状態

  • バージョン v0.1.0-beta – 機能的なコア機能、ユニットテスト、レグレッションフィクスチャが整備済み。READMEには、実際の結果はエージェントのコンテキストウィンドウ、ビジョン/OCR機能、インストールされたオプションパーサーの状態によって異なる可能性があると記載されている。

ライセンス

  • MITライセンス。book-to-skillおよびbook-to-webpageという2つの他のMITプロジェクトからの派生。

上記のすべての情報はリポジトリのREADMEから直接取得;追加の機能は推測されていない。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト