数据质量监控步骤及方法

发布时间:2020.08.31来源:CSDN浏览量:114次标签:数据治理

随着大数据时代的带来,数据的应用也日趋繁茂,越来越多的应用和服务都基于数据而建立,数据的重要性不言而喻。而且,数据质量是数据分析和数据挖掘结论有效性和准确性的基础,也是这一切的数据驱动决策的前提!如何保障数据质量,确保数据可用性是每一位数据人都不可忽略的重要环节。
数据质量监控
大数据处理中数据质量监控从哪几个方面进行?

数据容量(Volume):数据的大小决定所考虑的数据的价值的和潜在的信息;
数据种类(Variety):数据类型的多样性;
数据速度(Velocity):指获得数据的速度;
数据可变性(Variability):妨碍了处理和有效地管理数据的过程;
数据真实性(Veracity):数据的质量;
数据复杂性(Complexity):数据量巨大,来源多渠道。

数据质量监控怎么做?

四大关注点
先简单地聊一下数据质量需要关注的四个点:即完整性、准确性、一致性和及时性。这四个关注点,会在我们的数据处理流程的各个环节有所体现。

一、完整性
完整性是指数据的记录和信息是否完整,是否存在缺失的情况。数据的缺失主要包括记录的缺失和记录中某个字段信息的缺失,两者都会造成统计结果不准确,所以说完整性是数据质量最基础的保障。
简单来讲,如果要做监控,需要考虑两个方面:一是,数据条数是否少了,二是,某些字段的取值是否缺失。完整性的监控,多出现在日志级别的监控上,一般会在数据接入的时候来做数据完整性校验。

二、准确性
准确性是指数据中记录的信息和数据是否准确,是否存在异常或者错误的信息。
直观来讲就是看数据是否上准确的。一般准确性的监控多集中在对业务结果数据的监控,比如每日的活跃、收入等数据是否正常。

三、一致性
一致性是指同一指标在不同地方的结果是否一致。
数据不一致的情况,多出现在数据系统达到一定的复杂度后,同一指标会在多处进行计算,由于计算口径或者开发人员的不同,容易造成同一指标出现的不同的结果。

四、及时性
在确保数据的完整性、准确性和一致性后,接下来就要保障数据能够及时产出,这样才能体现数据的价值。
及时性很容易理解,主要就是数据计算出来的速度是否够快,这点在数据质量监控中可以体现在监控结果数据数据是否在指定时间点前计算完成。

数据质量监控之所以难做,是因为在数据的各个环节都会出现数据质量的问题。“大数据”是需要新处理模式才能具有更强的决策力、洞察发现力和流程优化能力的海量、高增长率和多样化的信息资产。好好把握这几个点才能更好地进行数据质量监控。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 数据管理与数据治理的区别

    数据管理与数据治理的区别

    数据管理和数据治理有很多地方是互相重叠的,它们都围绕数据这个领域展开,因此这两个术语经常被混为一谈。此外,每当人们提起数据管理和数据治理……查看详情

    发布时间:2019.08.27来源:DAMS浏览量:91次

  • 数据中台对企业的价值在哪里?

    数据中台对企业的价值在哪里?

    原来我们在做一张报表,或者是在业务系统里面需要查询一个数据结果的时候,它的过程是比较麻烦的,而且它的测试往往也是比较复杂的,因为业务系统……查看详情

    发布时间:2021.01.23来源:知乎浏览量:104次

  • 数据质量管理包括什么方面

    数据质量管理包括什么方面

    数据是组织最具价值的资产之一。企业的数据质量与业务绩效之间存在着直接联系,高质量的数据可以使公司保持竞争力并在经济动荡时期立于不败之地。……查看详情

    发布时间:2019.11.07来源:知乎浏览量:137次

  • 打开大数据的正确方式——做减法

    打开大数据的正确方式——做减法

    随着数字技术的广泛应用,原本的新奇感已经荡然无存。创新领域内积年累月的争夺不断攫取着人们的时间和注意力,反而令用户感到信息过载、不堪重负……查看详情

    发布时间:2019.04.09来源:亿信华辰浏览量:83次

  • 数据治理指标跟踪

    数据治理指标跟踪

    在NYU Langone Health System,提供者的角色不仅对患者至关重要,对整个企业也至关重要。提供者是为患者提供医疗保健的……查看详情

    发布时间:2019.03.22来源:亿信华辰浏览量:110次

  • BigID和Ionic安全合作伙伴为云和多云合规性增强数据治理和隐私

    BigID和Ionic安全合作伙伴为云和多云合规性增强数据治理和隐私

    BigID和Ionic安全合作伙伴为云和多云合规性增强数据治理和隐私以色列纽约和特拉维夫 - (BUSINESS WIRE)- (美国商……查看详情

    发布时间:2019.01.17来源:数据治理浏览量:79次

  • 开创数据治理新局面

    开创数据治理新局面

    当前,大数据发展日新月异。深入推动实施国家大数据战略需要深入了解大数据发展现状和趋势及其对经济社会发展的影响,分析我国大数据发展取得的成……查看详情

    发布时间:2019.02.25来源:光明网浏览量:99次

  • 数据标准管理体系-数据治理基础

    数据标准管理体系-数据治理基础

    目前企业缺乏专业化的信息标准管理流程,部门间缺乏沟通的统一渠道,导致标准变更和发布缺乏制度化要求,容易形成难以清理的问题数据。在短期规划……查看详情

    发布时间:2019.12.25来源:知乎浏览量:103次

  • 大数据治理需要具备哪些能力和关键技术?

    大数据治理需要具备哪些能力和关键技术?

    在企业数据建设过程中,大数据治理受到越来越多的重视。从企业数据资产管理和提升数据质量,到自服务和智能化的数据应用,大数据治理的内容在不断……查看详情

    发布时间:2019.11.22来源:CSDN浏览量:143次

  • 为什么企业架构需要成熟度模型

    为什么企业架构需要成熟度模型

    跑步之前走路。我们已经听过一百万次了,引用了几乎同样多的不同学科。然而,由于时间有限,想要快速完成任务往往是人性。然而,就像我们的第一步……查看详情

    发布时间:2019.02.26来源:亿信华辰浏览量:95次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议