数据治理的血缘分析

发布时间:2019.11.22来源:CSDN浏览量:197次标签:数据治理

数据治理里经常提到的一个词就是血缘分析,血缘分析是保证数据融合(聚合)的一个手段,通过血缘分析实现数据融合处理的可追溯。

有时被概念瞎蒙了,不知道到底如何追溯,落不了地。本人接触的数据治理项目还主要是将各个来源的数据进行整理融合,形成人地事物组织几个业务大类数据。至于详细的ODS、DWD、DWA等数据组织请阅读这篇文章:


数据治理概述
本文主要从数据追溯的业务需求来分析一下,一切还是要从需求出发,这里的数据处理都是Oracle关系数据库之间的融合,血缘分析就划分为表结构血缘分析和记录级的血缘分析;这两类业务场景:

表结构血缘分析
表结构血缘分析
针对表结构的情况,最终用户和运维用户最需要关注,目标表的每个字段的数据来源有哪些?也就是建立一个源表、源字段和目标表、目标字段的映射关系,一个目标表可以对应多个来源表的字段,比如:姓名字段,可能来至于户籍人口表也可能来至于流动人口表或老年人表,也就是意味着这三张表合并起来的人口,才是这个区域的所有人口.
通过上图我们就可以清楚的看到从目标表的目标字段出发,知道数据库中数据处理的规则,清楚的了解每个字段数据的来源。
至于其中ODS、DWD、DWA的关系,参照上面所述先去了解。

记录级血缘分析
记录级血缘分析
记录级的血缘分析,就是从当前记录出发可以按时间查看该记录所有的变更过程。一条记录的生成可能原始对应两个表的两条记录,这种是要追溯跟踪的。
如果再精细跟踪,就可以做到字段级的血缘分析,与表结构的血缘分析就可以完美呼应。
单击某一个字段,可查看该字段的血缘关系;一个是以此字段为目标的血缘追溯,一个是以此字段为源的血缘追溯
这里就要看具体应用需求来定,毕竟做的越精细实现方案会越复杂。
血缘分析毕竟解决的问题是数据出了错之后能明确知道是哪一步环节的哪个原始数据出问题了,所以一般到记录级就基本可以进行追溯跟踪了。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 数据治理与数据质量有何不同?

    数据治理与数据质量有何不同?

    当下是一个大数据的时代,有越来越多的企业开始应用大数据来创造价值,为了能够充分的利用数据价值,企业需要对数据进行管理,当我们听到数据管理……查看详情

    发布时间:2019.07.26来源:知乎浏览量:157次

  • 企业如何开展数据治理项目

    企业如何开展数据治理项目

    从大的阶段来看,数据治理主要分为存量数据“由乱到治”的阶段,以及增量数据严格按照规章制度实施确保“行不逾矩”的运营阶段。在“由乱到治”的……查看详情

    发布时间:2020.06.30来源:知乎浏览量:116次

  • 大数据时代的数据治理

    大数据时代的数据治理

    随着Hadoop技术的提升,数据如何进来,如何整合,开展什么样的应用都已经有了成熟的案例,可是,同传统数仓时代一样,垃圾进垃圾出,如何破……查看详情

    发布时间:2020.03.19来源:知乎浏览量:133次

  • 数据治理到底是什么?

    数据治理到底是什么?

    幸运的是,培训可以为精通数据的员工提供这些技能。通过正确的沟通工作,您的数据治理团队可以开展治理业务,确信他们能够为您的各种数据利益相关……查看详情

    发布时间:2019.03.19来源:亿信华辰浏览量:193次

  • 为什么您的主数据管理需要数据治理

    为什么您的主数据管理需要数据治理

    近年来,各组织越来越意识到他们的数据及其在最关键业务功能的成功或失败中所起的作用。这种思维方式的转变以及云技术的发展已经形成了技术预算变……查看详情

    发布时间:2018.12.25来源:数据治理浏览量:135次

  • 数据中心基于政府数据治理的工作清单

    数据中心基于政府数据治理的工作清单

    随着信息社会不断向纵深发展,数据和信息作为战略性资源的价值正在快速提升。人类社会正在进入数据时代,从关注网络、系统到注重数据,已成为当前……查看详情

    发布时间:2018.09.30来源:数据治理浏览量:182次

  • BigID和Ionic安全合作伙伴为云和多云合规性增强数据治理和隐私

    BigID和Ionic安全合作伙伴为云和多云合规性增强数据治理和隐私

    BigID和Ionic安全合作伙伴为云和多云合规性增强数据治理和隐私以色列纽约和特拉维夫 - (BUSINESS WIRE)- (美国商……查看详情

    发布时间:2019.01.17来源:数据治理浏览量:107次

  • 一文搞懂数据质量问题及对应的解决办法

    一文搞懂数据质量问题及对应的解决办法

    通过数据分析、数据评估、数据清洗、数据监控、错误预警等内容,解决数据质量问题,使数据的质量得以改善,使其满足数据需求方对数据质量的规则要……查看详情

    发布时间:2019.11.05来源:知乎浏览量:1321次

  • 社交网络大数据的应用有多大的价值

    社交网络大数据的应用有多大的价值

    随着互联网技术高速的发展,网民的数量呈指数上升,社交网络进入了强调用户参与和体验的时代。……查看详情

    发布时间:2019.03.13来源:亿信华辰浏览量:105次

  • 四个用例证明数据治理的自动化的好处

    四个用例证明数据治理的自动化的好处

    如果没有至少某种程度的元数据驱动的自动化,组织就无法充分利用数据驱动的战略。……查看详情

    发布时间:2019.02.15来源:亿信华辰浏览量:166次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议