OpenMetadata

统一元数据与血缘,让数据资产可发现、可信任、可被 AI 使用

开源 freemium 基础设施
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 15435
维护状态 活跃
是否开源 是
定价模式 freemium

项目预览

项目数据

分类基础设施
开发团队open-metadata
所属国家
定价模式freemium
价格说明开源版免费,云服务提供免费试用及付费订阅
访问状态
是否开源是
开源协议Apache-2.0
主要语言TypeScript
技术栈/模型context,context-layer,data-catalog,data-collaboration,data-contracts,data-discovery,data-governance,data-lineage,data-observability,data-profiling,data-quality,datadiscovery,dataquality,mcp,mcp-server,metadata,metadata-management,ontologies,ontologies-api,semantics
GitHub 星标★ 15435
30天Star增速
HF 下载量
上线时间2021-08-01 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-11
浏览次数0

项目介绍

OpenMetadata 是一个开源的数据目录与元数据管理平台,定位为数据与 AI 的开放上下文层。它解决的核心问题是:企业数据散落在各类数据库、数仓、BI 工具中,缺乏统一的元数据视图,导致数据发现难、血缘不清、治理无据可依,AI 助手和智能体也无法获得可信的业务语义。平台提供数据发现、数据血缘、数据契约、数据治理、数据协作等能力,支持自动采集技术元数据、追踪字段级血缘、定义业务术语和标签、设置数据质量与契约规则。通过统一 API 和 UI,人和 AI 都能查询到可信的数据上下文,从而让数据资产真正可被理解、可被信任、可被复用。

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

难度:入门 约 30 分钟 部署方式:本地安装 7 步

⚠ 该项目 README 未提供完整安装说明,以下步骤为通用流程,请以官方文档为准。

环境要求

  • 可访问互联网的浏览器(用于在线试用 Sandbox)
  • 实际部署所需的操作系统、CPU、内存等环境要求,README 未列出,需查阅官方 Quickstart 文档
  • 如要让 AI 助手接入,需要一个 MCP 客户端
  • 可访问的元数据源(数据库、数仓、BI、数据质量或血缘工具等)

安装与启动步骤

  1. 1先在线试用沙盒

    无需安装,直接打开 OpenMetadata Sandbox 地址,用浏览器体验数据发现、血缘与治理界面,判断是否符合需求。

  2. 2查阅快速开始文档

    README 未给出安装命令,请打开官方 Quickstart 指南,按其中针对你环境的步骤完成安装部署。

  3. 3采集元数据

    从数仓、BI 工具、调度系统、数据质量工具、血缘源、契约源或记忆类工作流中接入并采集技术元数据。

  4. 4构建数据上下文

    为资产补充描述、负责人、团队、域、数据产品、质量测试、新鲜度、使用情况、血缘与数据契约。

  5. 5补充业务语义

    通过术语表、分类、标签、指标、KPI、策略、域,以及 DCAT/DPROD 数据产品和 PROV-O 血缘上下文补充语义。

  6. 6捕获组织记忆

    把对话、AI 会话、事故、修复记录、假设与决策沉淀为记忆,供后续人和 AI 复用。

  7. 7开启语义搜索并连 MCP

    启用语义搜索让用户与 AI 按含义查找数据;再连接 MCP 客户端,或用 API、SDK、事件构建 AI 应用。

如何确认成功

README 未给出启动成功标志,请以官方 Quickstart 文档中的成功提示或可正常打开 UI 为准。

常见问题

Q:我不想部署,能先体验吗?

A:可以。README 提供 OpenMetadata Sandbox 在线沙盒,直接用浏览器打开即可试用数据发现、血缘、治理等能力,无需本地安装。

Q:为什么教程里没有 git clone 或 docker 命令?

A:README 节选只给出了 Quickstart Guide 链接和功能说明,没有列出任何安装命令、包名、端口或路径,为避免误导未做任何推测。

Q:支持接入哪些数据源?

A:README 称提供 130+ connectors,覆盖数仓、BI 工具、管道系统、数据质量工具、血缘源、契约源以及产生记忆的工作流。

Q:怎么让 AI 助手用上这些元数据?

A:连接一个 MCP 客户端,让 AI 助手和智能体获得受治理的上下文与记忆访问;也可通过 OpenMetadata 的 API、SDK、MCP 工具和事件构建应用。

注意事项

  • README 节选未包含安装命令、端口、路径或配置项,本教程步骤为基于 README 的通用准备流程,具体部署请以官方 Quickstart 文档为准。
  • 官方文档地址:https://docs.open-metadata.org/latest/quick-start;在线沙盒:https://sandbox.open-metadata.org。
  • 项目官网为 https://open-metadata.org,代码仓库为 https://github.com/open-metadata/OpenMetadata。
  • README 强调 AI 需要的不是又一个原始数据库连接器,而是上下文与记忆,因此接入后应优先完善语义、血缘与治理信息。

核心亮点

  • 提供字段级数据血缘,能追溯数据从源头到报表的完整链路
  • 内置数据契约与数据质量规则,支持主动治理而非事后补救
  • 开放 API 和元数据标准,便于 AI 助手和智能体接入业务语义

不足之处

  • 部署和运维复杂度较高,依赖多个组件,小团队上手成本不低
  • 中文社区和本地化文档相对薄弱,国内用户遇到问题排查周期较长

适用场景

  • 数据团队搭建统一数据目录,让分析师快速找到可信数据表
  • 治理团队定义业务术语和标签,统一全公司数据口径
  • AI 应用通过 API 获取数据上下文,让智能体理解业务语义

替代项目

DataHub、Amundsen

上一篇:sealos

下一篇:databend

同类项目推荐

freebuff-proxy 开源

聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。

[DEPRECATED / UNMAINTAINED] No longer maintained.

★ 300 2026-08-20
microduck 开源

用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。

A Tiny biped duck robot

★ 9285 2026-09-10
ollama 开源

一条命令本地跑起大模型,免费、私密、不卡顿

Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···

★ 182628 2026-08-09
soperator 开源

用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。

Run Slurm in Kubernetes

★ 444 2026-08-10