大数据治理的新范例

发布时间:2018.12.26来源:亿信华辰浏览量:132次标签:数据治理


数十年来,数据科学家已经拥有沙箱来探索数据并找到有价值的见解。在看似愉快的折衷方案中,分析师可以快速加载,操纵和组合企业和行业数据,以寻找新的见解和预测,而无需担心它们会危及敏感数据或生产工作流程。虽然这加速了创造新的见解,但将它们投入生产是一场噩梦。在未部署的环境中创建的一组自定义代码和数据需要在部署之前进行转换,质量控制和优化。企业通常需要一年的大部分时间才能从几周内收集的洞察中获得价值。 

大数据的幽灵有可能使情况变得更糟- 在很大程度上。现在,分析师们正在使用IT外部的数据结构和编程语言。外部数据源的数量和复杂性正在爆炸式增长。如果没有新的方法,在大数据沙箱中发现的洞察力可能永远不会投入生产。 

所出现的是一种新的范例,它将数据治理- 大多数分析师的诅咒这一术语 - 带入了大数据。但是,大数据治理不是严格限制数据使用和文档,而是灵活,协作和高效。它使分析师参与而非分离,以获取他们的学习以加速生产准备。最重要的是,它取代了沙箱数据的大规模转换,并采用“促销”流程,确保分析数据在大数据平台上生产就绪。 

大数据治理要求我们从头开始重新思考治理。大数据治理不是物理地分离沙箱和生产数据,而是逻辑地控制访问和使用,因为数据从“原始”到“准备”成熟。您如何判断数据是否已准备好生产?元数据。任何支持生产使用的大数据平台都必须具有跟踪数据摄取,验证,准备和使用生命周期的元数据。元数据需要管理数据访问权限,捕获数据分析结果以及数据开发人员和最终用户的评论。元数据存储定义生产准备的策略,并能够实施它们。没有元数据,数据湖就变成了数据沼泽。 

但为了实现这一点,元数据捕获必须是自动化和相关的。大数据治理的第二个原则与当前的教条相矛盾:从一开始就使用模式来丰富元数据。大多数业务数据都是结构化的,无论是关系数据库,日志文件,XML还是大型机副本。该结构可用于自动评估原始数据的质量,完整性和内容。这不仅为分析师提供了对数据的洞察力,还建立了一个可以构建的元数据基础。

大数据治理的第三个原则是记分卡驱动的优先级。并非所有数据都需要严格的质量和访问管理。实际上,假设大多数原始数据都不会被使用- 因此丰富其元数据是浪费时间。相反,记分卡是为数据的各种用途而创建的 - 合规报告,营销分析,供应链分析等。某些策略适用于所有记分卡 - 需要屏蔽PII数据 - 其他则非常具体 - 需要数据沿袭所有合规报告。使用元数据基础,可以轻松地为任何数据集创建记分卡。然后,这些记分卡用于识别治理工作并确定其优先级,以使最重要的数据生产就绪。 

从哪儿开始?如果您的数据库元数据较差,那么就建议您先评估现有资产的质量和内容。自动化工具可以填充元数据存储库,作为创建记分卡的基础。使湖泊的内容和质量透明是迈向大数据治理的第一步。



(部分内容来源网络,如有侵权请联系删除)
立即免费申请产品试用 免费试用
相关文章推荐
  • 数据治理寻求未来:平衡数据治理和数据管理

    数据治理寻求未来:平衡数据治理和数据管理

    想要通过快速访问高质量数据,灌输信心并支持数据驱动的决策,为业务合作伙伴创造竞争优势吗?那么这篇文章你一定得看!……查看详情

    发布时间:2019.08.29来源:知乎浏览量:114次

  • 如何建立有效的数据交换管理平台?

    如何建立有效的数据交换管理平台?

    随着企业综合管理水平的提高和信息化建设的开展和深入,企业数值转型也越发迫切,企业在转型过程中必然会有业务系统之间数据交换,但是数据交换又……查看详情

    发布时间:2020.04.22来源:知乎浏览量:186次

  • 在信息治理中处于领先地位

    在信息治理中处于领先地位

    随着这一关键战略的出现,应对最新的信息治理,以应对医疗保健领域的众多信息管理挑战。本博客将重点介绍IG为确保将信息视为组织资产而提出的趋……查看详情

    发布时间:2018.11.21来源:信息治理浏览量:154次

  • 企业如何建立主数据管理平台让数据增值

    企业如何建立主数据管理平台让数据增值

    90年代中期,ERP兴起并得到快速发展。然而,最早的ERP系统中并没有主数据(Masterdata)的概念,而是被称作基础数据。基础数据……查看详情

    发布时间:2020.08.28来源:知乎浏览量:199次

  • 数字化转型实例:数据如何改变酒店业

    数字化转型实例:数据如何改变酒店业

    组织采用数据驱动策略的速度意味着组织可以利用大量的数字转换示例。……查看详情

    发布时间:2019.02.18来源:亿信华辰浏览量:140次

  • 智与理的结合:当数据治理遇上人工智能

    智与理的结合:当数据治理遇上人工智能

    近日,中国移动研究院发布文章,解说了数据治理和人工智能两者之间各自发展历程,论证了两者在结构功能上的相互作用,阐明了两者共同发展的前……查看详情

    发布时间:2018.09.18来源:中国大数据产业观察网浏览量:409次

  • 让数据清澈如水:数据清洗的策略与方法

    让数据清澈如水:数据清洗的策略与方法

    在数据仓库中,数据是面向某一主题的数据的集合,这些数据从多个业务系统抽取而来,不同的数据来源加上历史数据的堆积,难免会有问题数据出现,这……查看详情

    发布时间:2020.11.23来源:亿信华辰浏览量:221次

  • 为什么数据治理会带来数据驱动的成功

    为什么数据治理会带来数据驱动的成功

    通过寻找创造价值和改进执行的新方法,各种形式和规模的组织都在积极地采用数据驱动的方法,这些方法可以通过分析的进步来实现。……查看详情

    发布时间:2019.01.26来源:亿信华辰浏览量:156次

  • 应用系统的数据治理一些关注点

    应用系统的数据治理一些关注点

    现在互联网公司业务发展都是非常飞速,当业务发展到一定规模,就得考虑如何去做服务治理,大家的重心一般放在微服务的应用架构设计层面,往往比……查看详情

    发布时间:2019.01.08来源:亿信华辰浏览量:230次

  • 大数据治理需要解决哪些问题?

    大数据治理需要解决哪些问题?

    随着云时代的来临,大数据也吸引了越来越多的关注。大数据需要特殊的技术,以有效地处理大量的容忍经过时间内的数据。适用于大数据的技术,包括大……查看详情

    发布时间:2018.10.15来源:数邦客浏览量:152次

相关主题
您点击 “提交”,表明您已理解并同意接受本网站隐私政策和用户协议