大数据平台建设系列:(二)浅谈数据仓库管理体系
首页 > >   作者:玉龙之乡  2020年2月8日 3:07 星期六  热度:7238°  字号:   评论:0 条
时间:2020-2-8 3:07   热度:7238°  评论:0 条 

数据仓库首要解决的问题是数据孤岛问题!在企业生产过程中,每个部门、子公司都会产生数据,数据如果不能统一管理,久而久之部门间或子公司间的数据会烟囱式生产,最终会形成数据孤岛。

数据孤岛只能片面的反应生产经营情况,缺乏全局的数据支持,是分析决策的大忌。因此,数据仓库在解决了数据孤岛问题后,才可以谈指标体系、资产管理等概念。良好的数据仓库管理体系需覆盖企业生产经营的所有数据,才能全面、真实、客观的反应企业发展情况。数据仓库需具备企业全域数据收集和存储能力(数据湖),在此基础上展开ETL分析。


大数据平台建设系列:(二)浅谈数据仓库管理体系

数据仓库管理体系图

为保证数据处理的时效性,实时数据仓库也需要规划到数据仓库体系中。数据仓库的下游对应不同主题域的数据集市,数据使用方从数据集市中获取他们需要的数据。

因此我觉得良好的数据仓库管理体系应该包含以下几部分内容:

1.数据湖:负责企业全范围的数据收集和存储,避免数据烟筒式生产的关键;

2.数据仓库:离线数据仓库(传统意义上的数据仓库)、实时数据仓库(解决数据时效性问题),负责对数据湖中的数据进行ETL;

3.数据集市:数据仓库分析结果的载体,根据不同场景划分为不同的主题域。是后续开展指标体系、数据质量体系,数据资产体系的关键因素。

 您阅读这篇文章共花了: 
捐赠支持:如果觉得这篇文章对您有帮助,请“扫一扫”鼓励作者!
 本文无需标签!
二维码加载中...
本文作者:玉龙之乡      文章标题: 大数据平台建设系列:(二)浅谈数据仓库管理体系
本文地址:http://liangzhidong.cn/post-110.html
版权声明:若无注明,本文皆为“玉龍之鄉”原创,转载请保留文章出处。

返回顶部    首页    手气不错    捐赠支持   后花园   
版权所有:玉龍之鄉    站长: 玉龙之乡   程序:emlog   蒙ICP备16004298号