yifanfeng97/Hyper-Extract

Hypergraph is more powerful. Transform unstructured text into structured knowledge with LLMs. Graphs, hypergraphs, and spatio-temporal extractions — with one command.

何を解決するか

Hyper-Extract は、非構造化テキストドキュメントを構造化された強型「知識抽象」に変換するための CLI ツールおよびフレームワークです。手動で情報を読み取り整理する作業を排除し、データを単純なリストから複雑な時空間グラフまでさまざまな形式に自動抽出することで、ユーザーが生成された知識ベースを照会・可視化できるようにします。

動作方法

このシステムは、Auto-Types(8種類の強型データ構造)、Methods(GraphRAG や LightRAG などの抽出アルゴリズム)、Templates(80以上あるドメイン固有のプリセット)からなる3層アーキテクチャを使用しています。選択されたテンプレートに基づいて、関数呼び出し機能を持つ LLM(GPT-4o、Claude、DeepSeek など)および OpenAI 互換の埋め込みモデルを活用してドキュメントを解析します。抽出されたデータは、新しいドキュメントが追加されるたびに段階的に進化可能な永続的な知識ベースとして保存されます。

対象ユーザー

  • 研究者:学術論文をインタラクティブな概念グラフに変換したい方。
  • 金融アナリスト:決算報告書からエンティティと指標を抽出したい方。
  • 開発者:データをオンプレミスに保つために vLLM を使用したローカル・プライベートデプロイを希望する方。
  • 知識マネージャー:Wikilinks を使って Obsidian でノートを整理したい方。

特徴

  • 多様な知識構造:ハイパーグラフや時空間グラフを含む 8 種類の構造をサポート。
  • 豊富なテンプレートライブラリ:金融、法務、医療など、80 以上の YAML テンプレートを提供。
  • マルチモデル対応:OpenAI、Anthropic、DeepSeek、Alibaba Cloud、およびローカルの vLLM デプロイに対応。
  • Obsidian 統合:抽出されたグラフを直接 Obsidian バルトにエクスポート可能。
  • MCP サーバー:Claude Desktop や IDE エージェントなど、MCP 対応アシスタントに知識抽象を公開。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト