如何保证所基于的数据具有高质量?

发布时间:2020.10.31来源:知乎浏览量:115次标签:数据治理

基于数据决策的前提是数据可靠且相关,数据必须是“真实可信的”,否则“输出将是误导和无效的”。但是学校所收集的数据可能不完全,或者更新不及时。不完全的数据,特别是不准确的数据,可能会带来更危险的决策。但是,所收集的数据来源多样,种类丰富,也很容易出现同一个数据(比如一所高校的在校生人数) 从不同的部门得到的数值不一样的情况。IBM 认为,高质量的数据具有以下四个特征:

完整性(Completeness): 要从所有可能的来源中关联相关的数据。

准确性(Accuracy): 数据必须是正确的、一致的,没有输入错误。

可用性(Availability): 数据必须在需要时可以获得。

时效性(Timeliness): 当下的数据必须可以获得。

为了提高数据的质量,可能需要多管齐下。

首先要制订数据治理政策,其次要开发和部署专门的工具来简化数据收集过程。美国的大多数高校会选择数据质量工具通过数据清理、匹配、监控和其他方式, 让质量保证过程自动化。

2013年圣母大学(University of Notre Dame)建立了商业智能(business intelligence)项目dataND ,经过摸索,发现制订数据治理政策非常有必要,即要定义数据是什么,如何使用这些数据,谁应该有权访问这些数据。其经验总结如下:

1.如何统一数据定义:雇佣了一个数据治理管家(a campus data steward)在部门之间协调,建立关于数据的共识。

2.如何确定谁能访问什么数据:正确的问题不是这个业务是否需要这个数据,而是获取这个数据是否会给大学带来风险,因为数据治理的目的是为了支持更广泛地使用数据,为了避免使用数据带来的风险,要加强对能够获得数据的人进行培训。当数据可能对大学造成重大伤害时,要有严格的限制。


2013年圣母大学(University of Notre Dame)建立了商业智能(business intelligence)项目dataND ,经过摸索,发现制订数据治理政策非常有必要,即要定义数据是什么,如何使用这些数据,谁应该有权访问这些数据。其经验总结如下:

1.如何统一数据定义:雇佣了一个数据治理管家(a campus data steward)在部门之间协调,建立关于数据的共识。

2.如何确定谁能访问什么数据:正确的问题不是这个业务是否需要这个数据,而是获取这个数据是否会给大学带来风险,因为数据治理的目的是为了支持更广泛地使用数据,为了避免使用数据带来的风险,要加强对能够获得数据的人进行培训。当数据可能对大学造成重大伤害时,要有严格的限制。
(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 理解数据治理

    理解数据治理

    专注于商业智能(bi)市场,深入了解组织在数据管理策略方面所面临的一些共同挑战。……查看详情

    发布时间:2019.01.09来源:亿信华辰浏览量:115次

  • 数据治理的十五个最佳实践

    数据治理的十五个最佳实践

    数据治理研究所(DGI)认为,它是一套切实可行的框架,帮助任何组织的各种数据利益相关方识别并满足其信息需求。DGI认为,企业不仅需要管理……查看详情

    发布时间:2020.07.31来源:知乎浏览量:134次

  • 物料主数据管理平台建设分享,助力多元化集团探索数据治理之路

    物料主数据管理平台建设分享,助力多元化集团探索数据治理之路

    随着大数据平台的建设,数据质量的好坏直接决定数据分析和数据挖掘的效果。如今,企业数据资产面临着不一致、不完整、不准确等问题,需要对数据进……查看详情

    发布时间:2021.04.20来源:浏览量:218次

  • 数据治理带给企业的6个惊喜

    数据治理带给企业的6个惊喜

    数据治理是GDPR的强制要求实际是一把双刃剑。一方面,法律法规的强制规定能立即引起客户对数据治理的重视。另一方面,为了达到合规,很多企业……查看详情

    发布时间:2019.08.07来源:CSDN浏览量:89次

  • 数据管理能力成熟度评估模型

    数据管理能力成熟度评估模型

    数据管理能力成熟度评估模型,中华人民共和国国家质量监督检验检疫总局,中国国家标准化管理委员会发布。……查看详情

    发布时间:2019.09.02来源:GB/T36073—2018浏览量:389次

  • 数据治理知识:怎么判断数据质量是否健康?

    数据治理知识:怎么判断数据质量是否健康?

    从数据质量检查开始:导出数据的子集并通过亿信华辰数据质量管理平台运行它 。这项软件服务可快速评估您数据的有效性、完整性和唯一性。……查看详情

    发布时间:2021.06.10来源:亿信华辰数据治理知识库浏览量:152次

  • 什么是数据质量?如何衡量它以获得最佳结果?

    什么是数据质量?如何衡量它以获得最佳结果?

    我们过去谈过很多关于数据质量的问题 - 包括糟糕数据的成本。但是,尽管对数据质量有了基本的了解,但许多人仍然不太了解“质量”究竟是什么意……查看详情

    发布时间:2018.12.25来源:数据治理浏览量:157次

  • 数据管理与数据治理的区别

    数据管理与数据治理的区别

    数据管理和数据治理有很多地方是互相重叠的,它们都围绕数据这个领域展开,因此这两个术语经常被混为一谈。此外,每当人们提起数据管理和数据治理……查看详情

    发布时间:2019.08.27来源:DAMS浏览量:119次

  • 产生影响:数据治理和企业架构的失落艺术

    产生影响:数据治理和企业架构的失落艺术

    看起来我们忙着跑步,以至于我们没有时间思考。我们希望更快,更快速,但我们甚至不确定我们想要实现的目标。这就像你办公室的人总是太忙,正在工……查看详情

    发布时间:2019.03.22来源:亿信华辰浏览量:109次

  • 数据治理和数据管理不可互换

    数据治理和数据管理不可互换

    从什么时候开始数据管理和数据治理可以互换? 这个问题让我感到困惑和沮丧。追求数据管理供应商与业务利益相关者建立联系,因为业务部门在决策……查看详情

    发布时间:2018.11.20来源:Michele Goetz浏览量:120次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议