Ontos-AI/knowhere

Knowhere extracts, parses, and outputs structured chunks ready for AI Agents and RAG.

What it solves

Knowhere 解決了「髒」的非結構化文件(例如複雜的 PDF、Office 檔案與影像)難以被 AI 代理使用的問題。傳統 RAG 常將這些文件平鋪成孤立的文字片段,導致語意上下文與層級遺失,進而降低 AI 代理回應的準確性與可靠性。

How it works

Knowhere 作為記憶層,將文件處理分為兩個主要階段:

  1. Parse and Build Memory:使用專門的解析器(如 MinerU)讀取多模態檔案。專有的樹狀演算法會重建文件原始的層級結構,並建立輕量化的記憶圖,確保分塊保留語意上下文與關係。
  2. Agentic Retrieval:AI 代理不再僅做向量查找,而是導航重建的章節樹與圖連結。這讓代理能「深入」文件的相關區域,類似人類閱讀的方式,並根據可追溯的來源路徑提供引用。

Who it’s for

此工具適合開發 AI 代理與 Agentic RAG 工作流程的開發者,需處理複雜、長篇或多模態文件,同時保持高檢索準確度與證據可追溯性。

Highlights

  • Multi-modal Support:使用 VLM 提取與摘要表格與影像,並將其連結回來源文字。
  • Hierarchy Preservation:重建文件結構,防止語意碎片化。
  • Agentic Navigation:結合傳統搜尋(RRF)與文件樹與圖的自主導航。
  • Broad Format Support:支援 PDF、DOCX、PPTX、XLSX、CSV、影像、Markdown 與純文字。
  • Model Agnostic:支援多種 LLM/VLM 供應商,包括 DeepSeek、Qwen、OpenAI 等。