数据治理的血缘分析

发布时间:2019.11.22来源:CSDN浏览量:192次标签:数据治理

数据治理里经常提到的一个词就是血缘分析,血缘分析是保证数据融合(聚合)的一个手段,通过血缘分析实现数据融合处理的可追溯。

有时被概念瞎蒙了,不知道到底如何追溯,落不了地。本人接触的数据治理项目还主要是将各个来源的数据进行整理融合,形成人地事物组织几个业务大类数据。至于详细的ODS、DWD、DWA等数据组织请阅读这篇文章:


数据治理概述
本文主要从数据追溯的业务需求来分析一下,一切还是要从需求出发,这里的数据处理都是Oracle关系数据库之间的融合,血缘分析就划分为表结构血缘分析和记录级的血缘分析;这两类业务场景:

表结构血缘分析
表结构血缘分析
针对表结构的情况,最终用户和运维用户最需要关注,目标表的每个字段的数据来源有哪些?也就是建立一个源表、源字段和目标表、目标字段的映射关系,一个目标表可以对应多个来源表的字段,比如:姓名字段,可能来至于户籍人口表也可能来至于流动人口表或老年人表,也就是意味着这三张表合并起来的人口,才是这个区域的所有人口.
通过上图我们就可以清楚的看到从目标表的目标字段出发,知道数据库中数据处理的规则,清楚的了解每个字段数据的来源。
至于其中ODS、DWD、DWA的关系,参照上面所述先去了解。

记录级血缘分析
记录级血缘分析
记录级的血缘分析,就是从当前记录出发可以按时间查看该记录所有的变更过程。一条记录的生成可能原始对应两个表的两条记录,这种是要追溯跟踪的。
如果再精细跟踪,就可以做到字段级的血缘分析,与表结构的血缘分析就可以完美呼应。
单击某一个字段,可查看该字段的血缘关系;一个是以此字段为目标的血缘追溯,一个是以此字段为源的血缘追溯
这里就要看具体应用需求来定,毕竟做的越精细实现方案会越复杂。
血缘分析毕竟解决的问题是数据出了错之后能明确知道是哪一步环节的哪个原始数据出问题了,所以一般到记录级就基本可以进行追溯跟踪了。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 说到数据治理,我们不得不要谈到的要素和落地方法

    说到数据治理,我们不得不要谈到的要素和落地方法

    据戴尔易安信最新调查显示:全球大多数企业现已认识到数据的价值,受管理的平均数据量从2016年的1.45PB增加至2018年的9.70PB……查看详情

    发布时间:2020.06.29来源:CSDN浏览量:150次

  • 数据治理唤醒“沉睡数据”

    数据治理唤醒“沉睡数据”

    十九届四中全会提出:“建立健全运用互联网、大数据、人工智能等技术手段进行行政管理的制度规则。推进数字政府建设,加强数据有序共享,依法保护……查看详情

    发布时间:2019.11.28来源:知乎浏览量:137次

  • 关于数据标准认识的几个误区

    关于数据标准认识的几个误区

    数据标准这个词,最早是在金融行业,特别是银行业的数据治理中开始使用的。数据标准工作一直是数据治理中的重要基础性内容。但是对于数据标准,不……查看详情

    发布时间:2019.12.20来源:知乎浏览量:123次

  • 大数据共享交换平台建设方案

    大数据共享交换平台建设方案

    数据交换共享平台,随着各行业信息化的发展,各行业系统及数据越来越多,也对IT系统建设提出了互联互通、共享交换、业务协同、数据治理等多方面……查看详情

    发布时间:2020.08.14来源:知乎浏览量:215次

  • 完善和高效的数据交换管理平台

    完善和高效的数据交换管理平台

    EsDataExchange是亿信华辰公司推出的一款解决企业和政府部门数据交换管理的成熟产品,该平台是亿信华辰公司自主研发的具有独立知识……查看详情

    发布时间:2020.04.23来源:知乎浏览量:122次

  • “安全”与“共享”同行,大数据正改变着世界

    “安全”与“共享”同行,大数据正改变着世界

    什么是大数据?早在2011年,世界著名咨询公司麦肯锡就曾在《大数据:下一个创新、竞争和生产力的前沿》报告中对其进行了基础定义:“大数据是……查看详情

    发布时间:2019.01.14来源:亿信华辰浏览量:147次

  • 数据科学的下一个「超能力」:模型可解释性

    数据科学的下一个「超能力」:模型可解释性

    很多人重视重视模型的预测能力,却忽略了模型可解释性的重要性,只知其然而不知其所以然。为什么说模型的可解释性这么重要呢?作者就 5 个方面……查看详情

    发布时间:2019.03.28来源:亿信华辰浏览量:133次

  • 数据治理指标跟踪

    数据治理指标跟踪

    在NYU Langone Health System,提供者的角色不仅对患者至关重要,对整个企业也至关重要。提供者是为患者提供医疗保健的……查看详情

    发布时间:2019.03.22来源:亿信华辰浏览量:157次

  • 如何成功实现一个数据治理项目,大神详细拆解实施要点

    如何成功实现一个数据治理项目,大神详细拆解实施要点

    数据作为新型生产要素,只有流动、分享、加工处理才能创造价值。如今数据治理成为数字经济必经之路,怎么实现一个数据治理项目成为大家最关心的问……查看详情

    发布时间:2021.02.02来源:知乎浏览量:244次

  • 强大的数据治理是机器学习成功的关键

    强大的数据治理是机器学习成功的关键

    人工智能和机器学习这两个术语通常被视为同一枚硬币的两面。尽管如此,虽然ML算法增强了AI功能,并使它们能够进行更多的尖端和智能计算,但还……查看详情

    发布时间:2019.01.17来源:数据治理浏览量:160次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议