open-metadata/OpenMetadata
The Open Context Layer for Data and AI , OpenMetadata is the open platform for building trusted data context and business semantics for humans, AI assistants, and agents.
解决的问题
OpenMetadata 为企业的数据提供统一的「上下文层」,解决了 AI 代理和人类用户缺乏业务含义、所有权和信任信号,无法安全有效地使用原始数据的问题。它通过提供经过治理的元数据、组织记忆和语义关系,避免 AI 仅依赖原始数据库连接。
工作原理
OpenMetadata 构建了一个以模式优先的元数据图,将技术元数据(模式、表)与运营信号(质量、新鲜度)、业务语义(术语表、KPI)以及组织记忆(对话、决策)相连接。它使用超过 130 个连接器从生态系统中收集数据,并利用开放标准(如 DCAT、PROV-O 和 OpenLineage)进行标准化。
该上下文通过 MCP 服务器、语义搜索和专用 AI SDK 变得可操作,使 LLM 和代理能够查询元数据图,以理解数据血缘、检查认证状态,或检索特定资产的历史决策。
适用人群
- AI 工程师:构建需要基于企业数据进行推理的可信 AI 助手或代理。
- 数据工程师和架构师:管理数据目录、血缘关系和数据契约。
- 数据治理官:确保组织内政策感知的上下文和数据质量。
- 编码代理:在生成 SQL 或 dbt 模型之前,需要理解模式和业务定义。
主要亮点
- 组织记忆:将对话、AI 线程和修复笔记作为与特定数据资产关联的「记忆碎片」进行捕获。
- MCP 服务器:使兼容 MCP 的 AI 助手能够使用自然语言与元数据图进行交互。
- 广泛的连接性:支持 130+ 个连接器,覆盖数据仓库、数据湖、BI 工具和 ML 平台。
- 语义搜索:允许用户和 AI 基于语义而非仅关键词查找资产。
- 开放标准:基于可互操作的标准构建,包括用于数据契约的 ODCS 3.1 和用于知识图谱的 JSON-LD。
相关
- 项目
- 项目
- 项目
- Dispatch
- 项目