大数据环境下数据质量管理面临的挑战

发布时间:2019.12.27来源:CSDN浏览量:165次标签:数据治理

随着三网融合、移动互联网、云计算、物联网的快速发展,数据的生产者、生产环节都在急速攀升,随之快速产生的数据呈指数级增长。在信息和网络技术飞速发展的今天,越来越多的企业业务和社会活动实现了数字化。全球最大的零售商沃尔玛,每天通过分布在世界各地的6000多家商店向全球客户销售超过2.67亿件商品,每小时获得2.5PB的交易数据。而物联网下的传感数据也慢慢发展成了大数据的主要来源之一。有研究估计,2015年全球数据量为8ZB,而到2020年则高达35.2ZB,是2015年数据量的44倍之多。此外,随着移动互联网、web2.0技术和电子商务技术的飞速发展,大量的多媒体内容在指数增长的数据量中发挥着重要作用。


大数据时代下的数据与传统数据呈现出了重大差别,直接影响到数据在流转环节中的各个方面,给数据存储处理分析性能、数据质量保障都带来了很大挑战。大数据与传统数据对比如表1所示。

由于以上特性,大数据的信息系统更容易产生数据质量问题:

(1)在数据收集方面,大数据的多样性决定了数据来源的复杂性。来源众多、结构各异、大量不同的数据源之间存在着冲突、不一致或相互矛盾的现象。在数据获取阶段保证数据定义的完整性、数据质量的可靠性尤为必要。

大数据与传统数据特点对比

理,远远处理不了大数据环境下的数据问题。

(3)由于高速性,数据的大量更新会导致过时数据迅速产生,也更易产生不一致数据。

(4)由于发展迅速,市场庞大,厂商众多,直接产生的数据或者产品产生的数据标准不完善,使得数据有更大的可能产生不一致和冲突。

(5)由于数据生产源头激增,产生的数据来源众多,结构各异,以及系统更新升级加快和应用技术更新换代频繁,使得不同的数据源之间、相同的数据源之间都可能存在着冲突、不一致或相互矛盾的现象,再加上数据收集与集成往往由多个团队协作完成,期间增大了数据处理过程中产生问题数据的概率。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 您不应该进行数据治理的3个理由

    您不应该进行数据治理的3个理由

    今天有很多关于数据治理的讨论。但令人惊讶的是,今天“进行数据治理”的组织数量并不高。在我看来,数据治理是现代数据驱动型企业的必备条件。但……查看详情

    发布时间:2018.12.13来源:数据治理浏览量:121次

  • 数据治理中元数据的作用

    数据治理中元数据的作用

    数据治理中元数据的作用主要体现在以下几方面:便捷的业务导航,提高数据质量,工作更高效,降低培训成本,消除知识不对称,高效精准沟通,降低数……查看详情

    发布时间:2019.08.08来源:CSDN浏览量:131次

  • 2019年IT关注的重点:大数据分析的存储架构

    2019年IT关注的重点:大数据分析的存储架构

    存储行业的技术专家和分析师预测,IT组织将专注于改进其存储架构,以便在2019年更好地利用数据分析、人工智能和物联网。并指出,改进大数据……查看详情

    发布时间:2019.03.26来源:亿信华辰浏览量:94次

  • 数据治理—审计委员会章程

    数据治理—审计委员会章程

    委员会应承担下列具体职责。委员会还应履行其他职责和责任,符合本章程,公司章程,管辖法律,纽约证券交易所的规则和条例,联邦证券法以及适用于……查看详情

    发布时间:2019.03.27来源:亿信华辰浏览量:157次

  • 大数据共享交换平台的功能需求

    大数据共享交换平台的功能需求

    大数据平台是集开发、配置、部署、管理、监控、安全于一体的数据交换全生命周期管理的数据交换平台。平台可快速构建、运行和管理分布式应用系统间……查看详情

    发布时间:2022.05.18来源:小亿浏览量:428次

  • 什么是数据治理及其为什么对您的业务至关重要?

    什么是数据治理及其为什么对您的业务至关重要?

    数据治理如何影响他们:由于您没有雇用一组全新的理事会成员,因此DGC数据治理的最大影响将是与数据和数据策略相关的额外工作。如果或出现问题……查看详情

    发布时间:2018.11.26来源:数据治理浏览量:174次

  • 银行业数据治理还面临着四方面的挑战

    银行业数据治理还面临着四方面的挑战

    一是数据整合度不高。银行内部数据虽多,涉及各个业务条线、各个部门,但未经系统化的治理,数据分布零散化,搜集整合存在错配,未能实现大数据集……查看详情

    发布时间:2019.11.29来源:知乎浏览量:134次

  • 快速理解数据仓库、数据湖、数据工厂、数据中台

    快速理解数据仓库、数据湖、数据工厂、数据中台

    数据生产的整个链条中,对于如何筑湖、如何选址建厂、按什么工序加工、以及如何配送,这是技术部门的事情,而“数据半成品”的沉淀和积累,却不是……查看详情

    发布时间:2021.04.13来源:亿信数据治理知识库浏览量:192次

  • 幸存下来的数据治理浪潮

    幸存下来的数据治理浪潮

    我们正在从大数据的狂野西部时期出现,当时的问题主要集中在技术上是否可行,而不是合法或道德。文化需要一段时间才能改变,工具的发展也需要时间……查看详情

    发布时间:2019.03.05来源:亿信华辰浏览量:114次

  • 数据治理和风险管理

    数据治理和风险管理

    风险管理对于任何数据驱动的业务都至关重要。前联邦调查局局长罗伯特·穆勒(Robert Mueller)曾说过,“只有两种类型的公司:那些……查看详情

    发布时间:2019.01.27来源:亿信华辰浏览量:145次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议