如何保证数据质量?针对性业务方面的数据质量如何提升

发布时间:2019.11.15来源:知乎浏览量:113次标签:数据治理

平时企业都会处理数据质量的问题,越来越能够懂得数据库整套系统的运行模式和模型概念,深深觉得数据挖掘的本质其实不仅仅是从海量的数据中发现有效的,有用的,有目的性的数据,深入来说,如果大数据平台里的数据质量根本无法保证,那么数据挖掘就是毫无意义的,命中率和精确度根本没有参考价值。但是问题就出在这里,外围系统抽取隔离的数据,要怎么样清洗和梳理才能够在数据的源头上尽可能的提高数据质量?不可能每个人都懂业务,对针对性业务方面的数据质量如何提升。

每个企业都会存在数据质量问题。所有人都知道数据分析、数据挖掘的80%工作量都在数据处理上。但是与数据分析、数据挖掘红得发紫的热度相比,数据处理显得冷清多了。

业务数据的生命周期说起。

数据的流转分为四个步骤:数据的产生、存储、加工和使用。

数据质量在这四个环节均会产生。所以需要有不同的手段。


在各个环节控制质量的最开始,我们需要对数据质量管理进行标准定义处理。即对元数据进行梳理,并按照元数据管理理念,对各个环节的数据进行管控。在此只探讨结构化数据,非结构化数据可以结构化之后再以此法继续。

0、元数据管理

元数据管理简单来说,就是建立一套标准的指标(度量)、口径(维度)等体系,建立相关的单位、分组等支撑信息。目的是保证各环节的数据一致性和统一性。

1、数据产生阶段的质量管理手段

方法:控制输入

尽可能的使用非开放式的输入手段,如下拉菜单、单复选框、时间控件、标签(支持自定义学习型)等。必须开放的输入部分,进行必要的校验。

互联网行业的log数据质量之高,简直不需要进行此步骤的管理!可以说互联网的log分析直接推动了大数据分析发展的进程。

2、数据存储阶段的质量管理手段

方法:数据统一在数据结构设计时,就应该按照标准对相同含义的字段统一命名、格式、精度等,排除数据的歧义。

3、数据加工阶段的质量管理手段

方法:数据清洗数据加工阶段的目的非常明确,但数据问题繁多,不同的问题需要使用不同的手段处理,详细操作手段见另外一个回答:数据挖掘中常用的数据清洗方法有哪些?

4、数据使用阶段的质量管理手段

数据使用阶段还需要质量管理?当然!无论是在数据分析还是数据挖掘之后,结果自然是要保存下来的,此时的数据仍然要按照标准,进行规范的管理,无论是存储结果的表名,还是字段、格式等。此外,在数据分析、挖掘的时候,也会有新的数据产生,此时依然需要进行标准化之后进行统一管理。

5、数据质量的持续监控和完善

数据质量管理并不是一个流程做完就结束了。如同戴明环一样,数据质量同样要建立一个环,不断发现问题,弥补问题。在各个环节新发现的各种问题,定期进行分析,确定应对方案,并加以改进。质量乃数据之根本,没有质量,数据便不可信,在此之上的数据分析、数据挖掘更是一纸空谈,甚至是大谬论。

工欲善其事,必先利其器,检测之前咱们有必要对检测工具有基本的认知:


亿信数据质量管理平台提供从标准定义、质量监控、绩效评估、质量分析、质量报告、重大问题及时告警、流程整改发起、系统管理等数据质量管理全过程的功能。通过事先定义好的规则、调度时间、工作流程,自动完成数据的质量检查,极大的减少人力的投入和过程干预,提升效率,减少误差。 同时遇到重大问题能够及时警告,对质量检查的结果提供多方式(界面、邮件、短信)告警,让用户及时了解到系统检查结果,避免重大问题的延误。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 数据治理管理干货 | 数据质量管理的方法

    数据治理管理干货 | 数据质量管理的方法

    原始数据通常包含错误,如果不做数据质量管理,可能会导致错误的结果。数据质量管理是数据治理中获得正确上下文和结论的基本步骤。……查看详情

    发布时间:2021.06.22来源:亿信数据治理知识库浏览量:112次

  • 数据治理中元数据的作用

    数据治理中元数据的作用

    数据治理中元数据的作用主要体现在以下几方面:便捷的业务导航,提高数据质量,工作更高效,降低培训成本,消除知识不对称,高效精准沟通,降低数……查看详情

    发布时间:2019.08.08来源:CSDN浏览量:101次

  • 一文讲透什么是数据治理和数据管理

    一文讲透什么是数据治理和数据管理

    数据管理和数据治理有很多地方是互相重叠的,它们都围绕数据这个领域展开,因此这两个术语经常被混为一谈。此外,每当人们提起数据管理和数据治理……查看详情

    发布时间:2020.07.29来源:今日头条浏览量:80次

  • 如何保证数据质量?针对性业务方面的数据质量如何提升

    如何保证数据质量?针对性业务方面的数据质量如何提升

    平时企业都会处理数据质量的问题,越来越能够懂得数据库整套系统的运行模式和模型概念,深深觉得数据挖掘的本质其实不仅仅是从海量的数据中发现有……查看详情

    发布时间:2019.11.15来源:知乎浏览量:113次

  • 大数据时代传统工业企业的转型之路

    大数据时代传统工业企业的转型之路

    基于互联网与大数据的企业商业模式创新,使得传统的生产、流通和消费等环节呈现出前所未有的“信息化”、“扁平化”和“无界化”。借助于大数据的……查看详情

    发布时间:2019.03.27来源:亿信华辰浏览量:82次

  • 数据标准在数据资产管理中的意义

    数据标准在数据资产管理中的意义

    尽管出现了很多专家和专著,但真正理解这个概念的人并不多,懂得如何实操数据资产管理、在企业中真正落地的更寥寥无几。笔者有幸参与了国内几个典……查看详情

    发布时间:2019.03.12来源:亿信华辰浏览量:105次

  • 企业数据治理需要的能力

    企业数据治理需要的能力

    数据治理必然带来新的标准的确立和旧系统的改造,是一个有破有立、无破不立的过程。这一过程设计大量的跨部门、跨条线、跨系统的沟通协调,同时也……查看详情

    发布时间:2021.09.06来源:亿信华辰浏览量:121次

  • 数据治理流程

    数据治理流程

    要真正把数据作为企业有价值的资产来管理,就必须像管理财务、人力资源等业务功能一样进行数据治理。财务功能由多个核心业务流程组成,如应付账款……查看详情

    发布时间:2019.08.19来源:CSDN浏览量:144次

  • 当前数据治理存在哪些问题和困难?

    当前数据治理存在哪些问题和困难?

    数据治理不只是技术问题,更是一个管理问题。例如大家常见的项目管理系统只是一个工具,如何让项目管理工具与项目管理思想相匹配才是项目管理系统……查看详情

    发布时间:2020.04.09来源:知乎浏览量:110次

  • 数据质量包含的要素有哪几点

    数据质量包含的要素有哪几点

    数据是企业最有价值的资产之一,越来越多的企业认识到了数据的重要性。企业的数据质量与企业经营业绩之间有着直接的关系。高质量的数据可以保持公……查看详情

    发布时间:2022.02.17来源:小亿浏览量:527次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议