Ontos-AI/knowhere

Knowhere extracts, parses, and outputs structured chunks ready for AI Agents and RAG.

What it solves

Knowhere 解决了“脏”非结构化文档(如复杂的 PDF、Office 文件和图片)难以被 AI 代理使用的问题。传统 RAG 往往将这些文档平铺为孤立的文本片段,导致语义上下文和层级丢失,从而降低 AI 代理响应的准确性和可靠性。

How it works

Knowhere 作为记忆层,将文档处理分为两个主要阶段:

  1. Parse and Build Memory:使用专门的解析器(如 MinerU)读取多模态文件。专有的树状算法会重建文档原始的层级结构,并构建轻量化的记忆图,确保块保持语义上下文和关系。
  2. Agentic Retrieval:AI 代理不再仅做向量查找,而是导航重建的章节树和图链接。这让代理能够“深入”文档的相关区域,类似人类阅读的方式,并根据可追溯的来源路径提供引用。

Who it’s for

它面向构建 AI 代理和 Agentic RAG 工作流的开发者,需要处理复杂、长篇或多模态文档,同时保持高检索准确度和基于证据的可追溯性。

Highlights

  • Multi-modal Support:使用 VLM 提取和摘要表格与图片,并将它们链接回源文本。
  • Hierarchy Preservation:重建文档结构,防止语义碎片化。
  • Agentic Navigation:结合传统搜索(RRF)与文档树和图的自主导航。
  • Broad Format Support:支持 PDF、DOCX、PPTX、XLSX、CSV、图片、Markdown 和文本。
  • Model Agnostic:支持多种 LLM/VLM 提供商,包括 DeepSeek、Qwen、OpenAI 等。