数据治理的血缘分析

发布时间:2019.11.22来源:CSDN浏览量:207次标签:数据治理

数据治理里经常提到的一个词就是血缘分析,血缘分析是保证数据融合(聚合)的一个手段,通过血缘分析实现数据融合处理的可追溯。

有时被概念瞎蒙了,不知道到底如何追溯,落不了地。本人接触的数据治理项目还主要是将各个来源的数据进行整理融合,形成人地事物组织几个业务大类数据。至于详细的ODS、DWD、DWA等数据组织请阅读这篇文章:


数据治理概述
本文主要从数据追溯的业务需求来分析一下,一切还是要从需求出发,这里的数据处理都是Oracle关系数据库之间的融合,血缘分析就划分为表结构血缘分析和记录级的血缘分析;这两类业务场景:

表结构血缘分析
表结构血缘分析
针对表结构的情况,最终用户和运维用户最需要关注,目标表的每个字段的数据来源有哪些?也就是建立一个源表、源字段和目标表、目标字段的映射关系,一个目标表可以对应多个来源表的字段,比如:姓名字段,可能来至于户籍人口表也可能来至于流动人口表或老年人表,也就是意味着这三张表合并起来的人口,才是这个区域的所有人口.
通过上图我们就可以清楚的看到从目标表的目标字段出发,知道数据库中数据处理的规则,清楚的了解每个字段数据的来源。
至于其中ODS、DWD、DWA的关系,参照上面所述先去了解。

记录级血缘分析
记录级血缘分析
记录级的血缘分析,就是从当前记录出发可以按时间查看该记录所有的变更过程。一条记录的生成可能原始对应两个表的两条记录,这种是要追溯跟踪的。
如果再精细跟踪,就可以做到字段级的血缘分析,与表结构的血缘分析就可以完美呼应。
单击某一个字段,可查看该字段的血缘关系;一个是以此字段为目标的血缘追溯,一个是以此字段为源的血缘追溯
这里就要看具体应用需求来定,毕竟做的越精细实现方案会越复杂。
血缘分析毕竟解决的问题是数据出了错之后能明确知道是哪一步环节的哪个原始数据出问题了,所以一般到记录级就基本可以进行追溯跟踪了。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 新形式的治理需要安全和道德地解锁数据价值

    新形式的治理需要安全和道德地解锁数据价值

    尽管今天的数据非常丰富,但其中大部分仍处于孤岛状态,这意味着需要新的治理结构来打开它并释放其对社会的潜在价值。……查看详情

    发布时间:2019.03.21来源:亿信华辰浏览量:127次

  • 数据清理的终极指南——亿信华辰

    数据清理的终极指南——亿信华辰

    我花了几个月的时间分析来自传感器、调查及日志等相关数据。无论我用多少图表,设计多么复杂的算法,结果总是会与预期不同。……查看详情

    发布时间:2019.03.20来源:数据清理浏览量:137次

  • 浅谈数据治理的发展趋势

    浅谈数据治理的发展趋势

    随着大数据技术的飞速发展,大数据已经融入到了各行各业,为了能让各企业的数据资产得到充分的利用,数据治理非常重要,如今数据治理已经逐渐成为……查看详情

    发布时间:2019.07.17来源:知乎浏览量:125次

  • 资金模型:资助数据治理

    资金模型:资助数据治理

    数据治理框架以两种方式解决资金问题……查看详情

    发布时间:2019.03.19来源:亿信华辰浏览量:188次

  • 数据治理流程

    数据治理流程

    数据治理流程必须通过TSDS数据治理流程审查TEA收集的所有数据。此过程允许用户监督 TEA如何从LEA收集立法规定的数据以及为stud……查看详情

    发布时间:2018.11.27来源:数据治理浏览量:211次

  • 云中的数据治理

    云中的数据治理

    IT中心,内部部署基础架构变得越来越复杂和昂贵,并且需要高技能的人力,因此企业现在将其IT和数据科学功能转移到云。云计算承诺提供低成本存……查看详情

    发布时间:2018.12.29来源:亿信华辰浏览量:166次

  • 主数据管理第二步——体系构建

    主数据管理第二步——体系构建

    “纸上得来终觉浅,绝知此事要躬行。”然而主数据管理工作该怎么做?流程是怎样的?责任如何落实?……这些问题无不与主数据管理体系的构建有着密……查看详情

    发布时间:2019.10.24来源:亿信华辰浏览量:194次

  • 数据治理是真实的,是需要的!

    数据治理是真实的,是需要的!

    有许多组织可以很好地管理和管理他们的数据。或者是足够好(无论对每个组织来说意味着什么)。但是,还有其他组织根本不管理和管理他们的数据。他……查看详情

    发布时间:2019.06.19来源:简书浏览量:160次

  • 人工智能商业化提速 创新奇智瞄准三大场景万亿市场

    人工智能商业化提速 创新奇智瞄准三大场景万亿市场

    “接下来的AI投资就是要去跟中国各行各业进行结合,把中国的后端效率大幅改进。而这个机会将不会小于过去几年阿里、腾讯那些前端的互联网巨头所……查看详情

    发布时间:2019.01.27来源:亿信华辰浏览量:159次

  • 全球数据质量和数据治理解决方案市场

    全球数据质量和数据治理解决方案市场

    在企业数据管理生态系统中,数据质量是一个广义的术语,指的是数据和/或过程的质量,完整性和一致性等。数据质量还意味着数据准确性和一致性的程……查看详情

    发布时间:2019.07.11来源:知乎浏览量:133次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议