数据治理的血缘分析

发布时间:2019.11.22来源:CSDN浏览量:197次标签:数据治理

数据治理里经常提到的一个词就是血缘分析,血缘分析是保证数据融合(聚合)的一个手段,通过血缘分析实现数据融合处理的可追溯。

有时被概念瞎蒙了,不知道到底如何追溯,落不了地。本人接触的数据治理项目还主要是将各个来源的数据进行整理融合,形成人地事物组织几个业务大类数据。至于详细的ODS、DWD、DWA等数据组织请阅读这篇文章:


数据治理概述
本文主要从数据追溯的业务需求来分析一下,一切还是要从需求出发,这里的数据处理都是Oracle关系数据库之间的融合,血缘分析就划分为表结构血缘分析和记录级的血缘分析;这两类业务场景:

表结构血缘分析
表结构血缘分析
针对表结构的情况,最终用户和运维用户最需要关注,目标表的每个字段的数据来源有哪些?也就是建立一个源表、源字段和目标表、目标字段的映射关系,一个目标表可以对应多个来源表的字段,比如:姓名字段,可能来至于户籍人口表也可能来至于流动人口表或老年人表,也就是意味着这三张表合并起来的人口,才是这个区域的所有人口.
通过上图我们就可以清楚的看到从目标表的目标字段出发,知道数据库中数据处理的规则,清楚的了解每个字段数据的来源。
至于其中ODS、DWD、DWA的关系,参照上面所述先去了解。

记录级血缘分析
记录级血缘分析
记录级的血缘分析,就是从当前记录出发可以按时间查看该记录所有的变更过程。一条记录的生成可能原始对应两个表的两条记录,这种是要追溯跟踪的。
如果再精细跟踪,就可以做到字段级的血缘分析,与表结构的血缘分析就可以完美呼应。
单击某一个字段,可查看该字段的血缘关系;一个是以此字段为目标的血缘追溯,一个是以此字段为源的血缘追溯
这里就要看具体应用需求来定,毕竟做的越精细实现方案会越复杂。
血缘分析毕竟解决的问题是数据出了错之后能明确知道是哪一步环节的哪个原始数据出问题了,所以一般到记录级就基本可以进行追溯跟踪了。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 为什么你应该有一个数据治理策略

    为什么你应该有一个数据治理策略

    有效的数据治理也是一个持续的过程。政策定义,审查,调整和审计以及合规审查和质量控制都会作为数据治理生命周期经常受到影响或重复。因此,数据……查看详情

    发布时间:2019.03.08来源:亿信华辰浏览量:151次

  • 用数据治理来拯救当今的大数据应用

    用数据治理来拯救当今的大数据应用

    当今社会,大数据的应用越来越广泛,企业和大数据的结合也越来越紧密。数据,俨然已成企业的重要资产之一。但是,大数据却并不是那么好管理,数据……查看详情

    发布时间:2019.08.15来源:知乎浏览量:114次

  • 什么阻碍了数据治理更好的发展?

    什么阻碍了数据治理更好的发展?

    数据治理正迅速成为全球政策优先事项,这是正确的。已建立的利益和强大的公司正在以令人眼花缭乱的速度构建和重新构建关于数据治理的公众辩论,并……查看详情

    发布时间:2019.07.11来源:知乎浏览量:120次

  • 4+7集采进入大数据时代,科技巨头驱动医药行业大变局

    4+7集采进入大数据时代,科技巨头驱动医药行业大变局

    未来的医疗大数据将影响整个医药产业格局。 根据国家医保局及“4+7”带量采购发布的文件,包括天津、大连、沈阳等城市药品带量采购细则……查看详情

    发布时间:2019.03.28来源:亿信华辰浏览量:105次

  • 不再有肮脏的数据:关于数据治理的五个提示

    不再有肮脏的数据:关于数据治理的五个提示

    确保您的数据获得和保持干净需要正确的数据治理方法。……查看详情

    发布时间:2019.01.09来源:亿信华辰浏览量:159次

  • 数据治理那些事儿

    数据治理那些事儿

    业务分析师不得不对IT部门负责,因为他们不知道如何导航信息管理系统数据库,即使他们可以也不会被授予访问权限。IT部门打印出月度报告并分发……查看详情

    发布时间:2019.08.29来源:简书浏览量:161次

  • 数据囤积日益增长的威胁

    数据囤积日益增长的威胁

    在数据丰富的环境中生活和工作的缺点之一是希望将所有最后的位和字节松开以备将来使用。得益于Amazon S3和Hadoop等廉价存储系统,……查看详情

    发布时间:2019.02.28来源:亿信华辰浏览量:134次

  • 数据管理自动化框架的五个好处

    数据管理自动化框架的五个好处

    组织负责管理比以往任何时候都多的数据,使一个强大的自动化框架成为必要。但是自动化框架到底是什么,它又有什么关系呢?……查看详情

    发布时间:2019.02.13来源:亿信华辰浏览量:168次

  • 不要欺骗自己关于数据管理

    不要欺骗自己关于数据管理

    采用数据战略的早期阶段通常涉及数据管理的临时方法。企业不是投资于一套新工具,而是倾向于使用已经完成的工作,从小规模开始并最终形成方法。……查看详情

    发布时间:2019.02.25来源:亿信华辰浏览量:140次

  • 银行业数据治理实践难点及应对-数据治理实践

    银行业数据治理实践难点及应对-数据治理实践

    数据治理已成为在全球各国领导层面进行讨论的中心议题,其背景和目的,主要是旨在推动建立新的国际数据监管体系。在我国的金融行业中,随着互联网……查看详情

    发布时间:2019.12.20来源:知乎浏览量:163次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议