数据治理、共享交换、数据仓库、数据中心的关系
发布时间:2019.08.07来源:CSDN浏览量:157次标签:数据治理
建数据中心离不开数据,以前设计数据库都是从事务性数据库考虑(做的都是业务系统,思维模式太固定了),没有从数据仓库的角度来统管分析。以下是从数据仓库的角度考虑数据中心的建设:
政府的数据中心建设基本就包括这几个步骤:
1、数据源:支持不同部门的各类来源数据,包括文件型、数据库型、Http服务型和JMS消息型,可以读取各类数据
2、数据汇聚:这里是通过软件实现原始数据的读取存储,将不同的数据都存储到各自的数据库;因为保证与每个部门不发生扯皮的问题,所以必须保证读取的原始数据是对的,要独立存储不做任何加工,组织就按照同步的部门科室进行存放;所以就对应数据仓库的ODS层
3、数据处理:这里是对汇聚的原始数据进行初步的ETL处理,实现对数据的清洗、加工,补全各类信息(包括编码字典解释等),这个步骤的目的是实现数据的规范化,这里的数据也是落地存储物理库,作为抽取中间库DWD层
4、数据融合:这里是对规范化的原始数据进行融合处理,建立数据之间的关系模型,比如抽取成独立的人口库模型:
数据融合主要是按照一个业务领域进行数据建模。
5、数据集市:是对领域模型数据进行汇总统计分析,将统计分析的结果进行存储,简单解释可以理解为一般业务统计的中间表(提高统计效率,将统计成果进行定期存储),当然这里不止这么点,结合现在时髦的大数据分析,也就是将分析结果在集市层存储,为上层应用提供数据源。
6、最后一个是核心的元数据库,这里的元数据核心要存储以上4个库的表及字段元数据,可以实现整个数据处理过程的追溯。
从以上分析,了解共享交换的同学,可能直接就说了上面的数据汇聚、数据处理不就是传统的交换吗?只是换了一个说法;这个说法也没问题,只是这里是从政府业务和数据仓库的角度来说,传统的交换是直接将原始数据文件读取到后进行了ETL处理,形成交换库;这里是从政府安全追责的角度分析,形成2个步骤;所以数据中心的建设是包括数据交换的,只是交换处理的思路在变化。
从数据处理到数据融合,这里是要创建业务模型,按照业务模型进行数据处理,处理的工具一般也是ETL工具;所以共享交换只是强调了软件技术,没有从整体进行规划,它只是真个数据中心建设里的一个技术工具之一。
从数据融合到数据集市,又有几种形态:1、传统的数据统计,2、数据挖掘,3、大数据分析;这几种技术都可以形成数据集市的数据。
数据治理是一个更大的概念:
在数据仓库的基础上,更加强调数据的质量与数据安全;现在的数据治理也是叫大数据治理,是大数据建设的基础,毕竟是强调大数据平台里的核心,数据部分。只有数据是可依靠的,才能用来做大数据分析,否则就是无源之水了,谁也不敢相信。
数据质量,核心就是要依靠元数据的管理;来实现整个数据处理过程的跟踪,知道目标数据的源头可以一步步的追溯到数据的提供者。
数据中心则是一个业务上的叫法,包括机制规范、相关软件、数据、处理过程的构建,都是数据中心建设的步骤。数据中心就是通过数据治理形成可以对外统一提供服务的数据。
-
方法论:如何从0到1搭建企业级主数据管理平台
企业主数据是用来描述企业核心业务实体的数据,比如客户、合作伙伴、员工、产品、物料单、账户等;它是具有高业务价值的、可以在企业内跨越各个业……查看详情发布时间:2020.12.04来源:知乎浏览量:159次
-
企业应该将数据治理作为加速数字化转型的催化剂
随着许多业务系统和应用程序(包括采购,呼叫中心交互,网站访问,移动应用程序使用以及越来越多的物联网传感器和设备)产生的大量客户数据,应该……查看详情发布时间:2019.07.04来源:知乎浏览量:85次
-
企业大数据的现状与痛点——《企业大数据实践路线》之一
内容分类:1、 企业大数据现状及痛点 2、 大数据对企业的促进作用 3、 解析业务数据的特征 4、 典型技术架构的分析和构建……查看详情发布时间:2019.02.25来源:亿信华辰浏览量:156次
-
数据沿袭工具如何促进数据治理策略
企业可以通过跟踪数据更改的方式和时间来加强数据治理工作。专家David Loshin就如何使用数据沿袭产品提供建议。……查看详情发布时间:2019.03.26来源:亿信华辰浏览量:118次
-
全方位解读 | 了解数据治理、挑战及数据治理工具
早在 2000 年代初,企业就将数据视为公司的战略资产,以指导战略决策,促进实验学习和改进,并提供更好的业务成果。数据安全已成为企业的重……查看详情发布时间:2021.07.29来源:亿信数据治理知识库浏览量:155次
-
企业在什么情况下需要数据交换管理平台?
许多企业初期采用手工录入、脚本处理、传统工具做数据的交换,从目前的信息化现状来看存在着很大的弊端,首先是数据来源不一,库表、文件、接口无……查看详情发布时间:2020.04.22来源:知乎浏览量:95次
-
从信息安全角度看大数据管理风险
无论是从企业存储策略与环境来看,还是从数据与存储操作的角度来看,大数据带来的“管理风险”不仅日益突出,而且如果不能妥善解决,将肯定会造成……查看详情发布时间:2019.03.05来源:亿信华辰浏览量:106次
-
统一数据交换平台解决方案
随着我国信息化工程建设的迅速发展,各政府部门及各大企业内部都建立了各自的信息处理系统。这些信息系统往往是在不同时期、由不同厂商、在不同平……查看详情发布时间:2020.08.07来源:知乎浏览量:126次
-
数据管理与数据治理的区别
数据管理和数据治理有很多地方是互相重叠的,它们都围绕数据这个领域展开,因此这两个术语经常被混为一谈。此外,每当人们提起数据管理和数据治理……查看详情发布时间:2019.08.27来源:DAMS浏览量:106次