大数据环境下数据质量管理面临的挑战

发布时间:2019.12.27来源:CSDN浏览量:181次标签:数据治理

随着三网融合、移动互联网、云计算、物联网的快速发展,数据的生产者、生产环节都在急速攀升,随之快速产生的数据呈指数级增长。在信息和网络技术飞速发展的今天,越来越多的企业业务和社会活动实现了数字化。全球最大的零售商沃尔玛,每天通过分布在世界各地的6000多家商店向全球客户销售超过2.67亿件商品,每小时获得2.5PB的交易数据。而物联网下的传感数据也慢慢发展成了大数据的主要来源之一。有研究估计,2015年全球数据量为8ZB,而到2020年则高达35.2ZB,是2015年数据量的44倍之多。此外,随着移动互联网、web2.0技术和电子商务技术的飞速发展,大量的多媒体内容在指数增长的数据量中发挥着重要作用。


大数据时代下的数据与传统数据呈现出了重大差别,直接影响到数据在流转环节中的各个方面,给数据存储处理分析性能、数据质量保障都带来了很大挑战。大数据与传统数据对比如表1所示。

由于以上特性,大数据的信息系统更容易产生数据质量问题:

(1)在数据收集方面,大数据的多样性决定了数据来源的复杂性。来源众多、结构各异、大量不同的数据源之间存在着冲突、不一致或相互矛盾的现象。在数据获取阶段保证数据定义的完整性、数据质量的可靠性尤为必要。

大数据与传统数据特点对比

理,远远处理不了大数据环境下的数据问题。

(3)由于高速性,数据的大量更新会导致过时数据迅速产生,也更易产生不一致数据。

(4)由于发展迅速,市场庞大,厂商众多,直接产生的数据或者产品产生的数据标准不完善,使得数据有更大的可能产生不一致和冲突。

(5)由于数据生产源头激增,产生的数据来源众多,结构各异,以及系统更新升级加快和应用技术更新换代频繁,使得不同的数据源之间、相同的数据源之间都可能存在着冲突、不一致或相互矛盾的现象,再加上数据收集与集成往往由多个团队协作完成,期间增大了数据处理过程中产生问题数据的概率。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 数字化时代的大数据治理应该怎么做呢?

    数字化时代的大数据治理应该怎么做呢?

    随着时代的发展,各个企业收集数据的渠道越来越多样化,也有越来越多的企业开始应用大数据来创造价值,为了合理有效的挖掘数据资源来源的价值,首……查看详情

    发布时间:2019.07.18来源:知乎浏览量:162次

  • 数据治理:医院要平衡的4个考虑因素

    数据治理:医院要平衡的4个考虑因素

    电子健康倡议基金会,一个专注于质量和安全改进的医疗保健合作,以及LexisNexis Risk Solutions的医疗保健部门,于8月……查看详情

    发布时间:2018.11.27来源:Jessica Kim Cohen浏览量:117次

  • 数据仓库的定义,它有什么作用?

    数据仓库的定义,它有什么作用?

    最简单的数据仓库是用于存储和报告数据的系统。数据通常源自多个系统,然后将其移入数据仓库以进行长期存储和分析。该存储的结构使得组织内的许多……查看详情

    发布时间:2018.12.20来源:数据治理浏览量:150次

  • 如何做好大数据的质量管理?

    如何做好大数据的质量管理?

    如今关于大数据的话题非常火热,关于但数据的质量问题也备受人们关注,有很多IT人士开始认为,在大数据的时代,只有对数据进行有效的管理,那么……查看详情

    发布时间:2019.07.26来源:知乎浏览量:180次

  • 数据治理面临的挑战

    数据治理面临的挑战

    本部分的内容将数据治理面临的挑战分为两类,一类因“技术”而起,一类因“人”而起。由客观的技术问题对数据治理带来的挑战普遍较好解决,比如如……查看详情

    发布时间:2019.11.01来源:知乎浏览量:194次

  • 典型技术架构的分析和构建——《企业大数据实践路线》

    典型技术架构的分析和构建——《企业大数据实践路线》

    可能听了我的分享或者别人的分享,大家都会跃跃欲试。我们需要从哪一个方面去入手去改造大数据业务呢?我整理了一下,一个大数据应用的一个完整流……查看详情

    发布时间:2019.02.26来源:亿信华辰浏览量:125次

  • 数据中台和业务中台的区别

    数据中台和业务中台的区别

    数据中台是什么?数据中使前台更智慧。当然它也可以加快前台的开发速度,但它更重要的是使前台更智慧。业务系统,原来是跨类的,是分领域的财务系……查看详情

    发布时间:2021.01.23来源:头条浏览量:171次

  • 数据治理-理数据,现状分析

    数据治理-理数据,现状分析

    针对企业数据治理所处的内外部环境,从组织、人员、流程、数据四个方面入手,进行数据治理现状的分析。……查看详情

    发布时间:2020.07.17来源:知乎浏览量:183次

  • 数据安全—“无悔”的正确步骤

    数据安全—“无悔”的正确步骤

    谈到数据安全性,你必定不希望有遗憾。我们从马克扎克伯格那里知道了数据安全正在成为互联网公司的头等大事。正如我们知道的,这位首席执行官正处……查看详情

    发布时间:2019.06.19来源:知乎浏览量:117次

  • 怎么做好数据管理——亿信华辰

    怎么做好数据管理——亿信华辰

    数据化管理是指将业务工作通过完善的基础统计报表体系、数据分析体系进行明确计量、科学分析、精准定性,以数据报表的形式进行记录、查询、汇报、……查看详情

    发布时间:2019.03.07来源:亿信华辰浏览量:131次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议