数据质量问题分析

发布时间:2019.01.07来源:亿信华辰浏览量:211次标签:数据治理


数据质量问题主要包含四个问题域:技术问题、信息问题、流程问题、管理问题。

1、技术问题

由于具体数据处理的各技术环节异常所造成的数据质量问题,它产生的直接原因是技术实现上的某种缺陷。技术类数据质量问题产生的环节主要包括:数据创建、数据获取、数据传递、数据装载、数据使用、数据维护等方面:

数据创建质量问题主要包括:创建数据默认值使用不当和数据录入的校验规则不当,导致指标统计结果不一致、数据无效、记录重复等;

数据传递质量问题主要包括:接口数据及时率低、接口数据漏传、网络传输过程不可靠,如包丢失、文件传输方式错误、传输技术问题、协议使用不当导致的数据不完整等;

数据装载质量问题主要包括:数据清洗算法、数据转换算法和数据加载算法的错误;

2、信息问题

由于对数据本身的描述、理解及其度量标准的偏差而造成的数据质量问题。产生这类数据质量问题的原因主要有:元数据描述及理解错误、数据度量的各种性质得不到保证、变化频度不恰当等。

元数据描述及理解错误中的相关元数据主要包括:

业务元数据——主要包括业务描述、业务规则、业务术语、业务指标口径等;

技术元数据——主要包括接口规范、执行顺序、依赖关系、ETL转换、数据建模和工具等方面的内容。

数据度量和变化频度提供了衡量数据质量好坏的手段。数据度量主要包括完整性、唯一性、一致性、准确性、合法性。变化频度主要包括业务系统数据的变化周期和实体数据的刷新周期。

3、流程问题

由于系统作业流程和人工操作流程设置不当造成的数据质量问题,主要来源于系统数据的创建流程、传递流程、装载流程、使用流程、维护流程等各环节:

创建流程质量问题主要指操作员数据录入时缺乏审核流程;

传递流程质量问题主要指通信流程沟通不畅;

装载流程质量问题主要指清洗流程缺乏/不当、调度流程逻辑错误、数据加载流程逻辑错误及数据转换流程逻辑错误;

使用流程质量问题主要指数据使用流程缺乏流程管理;

维护流程质量问题主要指缺乏变更维护流程、缺乏错误数据维护流程、缺乏数据测试流程以及对人工后台调整数据没有严格的流程监控;

4、管理问题

由于人员素质及管理机制方面的 原因 造成的数据质量问题如:

数据库设计原则不严谨,数据使用不规范导致的业务数据重复,数据不一致。

人员培训所产生的质量问题主要指对数据质量相关人员缺少长期培训计划。

没有建立管理数据质量的专门机构,出现数据质量问题后无专人负责

没有明确的数据质量目标;

缺少管理数据质量的管理办法等。

此对数据质量产品的问题进行了部分的描述,高质量的数据都是一致的,差质量的数据却各有不同。可能因为行业的不同,数据的复杂程度不同,产生的问题也会各有差别。但都可以在四个问题域里找到对应的问题。所有这个总结,还是很全面的解释了相关数据质量产生的相关问题。


(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 大数据会取代传统BI吗

    大数据会取代传统BI吗

    BI一词早在20年前就被提出,加特纳集团将商业智能定义为描述一系列的概念和方法,通过应用基于事实的支持系统来辅助商业决策的制定。……查看详情

    发布时间:2019.03.14来源:亿信华辰浏览量:166次

  • 数据建模和数据映射:来自任何数据的结果

    数据建模和数据映射:来自任何数据的结果

    统一的数据建模和数据映射方法可能是许多数据驱动型组织所需要的突破。在我与客户进行的大多数对话中,他们表示需要一个可行的解决方案来模拟他……查看详情

    发布时间:2019.01.17来源:亿信华辰浏览量:308次

  • 大数据时代,我们将面临数据治理的新阶段

    大数据时代,我们将面临数据治理的新阶段

    目前业界并没有对其概念的统一标准定义,我们可以这么认为,数据治理从本质上看就是对一个机构(企业或政府部门)的数据从收集融合到分析管理和利……查看详情

    发布时间:2020.03.26来源:知乎浏览量:152次

  • 大数据环境下数据质量管理面临的挑战

    大数据环境下数据质量管理面临的挑战

    随着三网融合、移动互联网、云计算、物联网的快速发展,数据的生产者、生产环节都在急速攀升,随之快速产生的数据呈指数级增长。在信息和网络技术……查看详情

    发布时间:2019.12.27来源:CSDN浏览量:230次

  • 大数据治理需要具备哪些能力和关键技术

    大数据治理需要具备哪些能力和关键技术

    从企业的数据资产管理和提升数据质量等的数据应用上,大数据治理的内容在不断地发展和完善,在其落地实施的过程中面临着巨大的挑战。我们现在通过……查看详情

    发布时间:2019.08.13来源:知乎浏览量:178次

  • 2018年十大数据泄露安全事件盘点

    2018年十大数据泄露安全事件盘点

    数据安全任重道远,如何在互联网发展的大潮下同时确保信息安全,已经成为全世界各行业普遍关注的焦点问题。2018年以来,数据泄漏事故、勒索软……查看详情

    发布时间:2019.01.10来源:浏览量:168次

  • 为什么数据治理是数据管理的关键

    为什么数据治理是数据管理的关键

    如果要将数据用于战略业务决策,运营效率,增加盈利能力和增强增长,那么正确管理数据至关重要。管理不善的数据导致数据不信任,数据利用率很快就……查看详情

    发布时间:2019.06.18来源:知乎浏览量:167次

  • 企业数据质量管理的核心要素和技术原则

    企业数据质量管理的核心要素和技术原则

    “十三五”,规划提出了国家的大数据战略,指出了企业实现以数字化驱动业务发展,实现数据开放共享,创新业务发展的新思路。现阶段大中型企业已经……查看详情

    发布时间:2020.01.09来源:CSDN浏览量:401次

  • 确保数据治理正确 - 为医疗机构提供五个机会

    确保数据治理正确 - 为医疗机构提供五个机会

    医疗保健组织拥有的数据非常有价值 - 它可能是他们拥有的最有价值的资产。在个人层面,患者数据通常包含了解疾病和潜在康复的关键。从更广泛的……查看详情

    发布时间:2019.02.25来源:亿信华辰浏览量:174次

  • 企业如何有效进行数据治理

    企业如何有效进行数据治理

    如果你处理或使用过大量数据,一定有听到过“数据治理”这个词。你会思考数据治理是什么?……查看详情

    发布时间:2019.01.18来源:亿信华辰浏览量:194次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议