数据仓库的定义及基本特征

数据仓库的定义及基本特征

ID:46233153

大小:386.34 KB

页数:10页

时间:2019-11-21

数据仓库的定义及基本特征_第1页
数据仓库的定义及基本特征_第2页
数据仓库的定义及基本特征_第3页
数据仓库的定义及基本特征_第4页
数据仓库的定义及基本特征_第5页
资源描述:

《数据仓库的定义及基本特征》由会员上传分享,免费在线阅读,更多相关内容在教育资源-天天文库

1、1.1.2数据仓库的定义及其基本特征什么是数据仓库(DW)[1]?数据仓库的定义很多,但却很难有一种严格的定义(1)它是一个提供决策支持功能的数据库,它与公司的操作数据库分开维护。(2)为统一的历史数据分析提供坚实的平台,对信息处理提供支持“数据仓库是一个面向主题的、集成的、随时间而变化的、不容易丢失的数据集合,支持管理部门的决策过程。”---W.H.Inmon(数据仓库构造方面的领头设计师)建立数据仓库(datawarehousing)构造和使用数据仓库的过程数据仓库关键特征一——面向主题[2]围绕一些主题,如顾客、供应商、产品等关注决策者的数据建模与分

2、析,而不是集中于组织机构的日常操作和事务处理排除对于决策无用的数据,提供特定主题的简明视图数据仓库关键特征二——数据集成[3]一个数据仓库是通过集成多个异种数据源来构造的。关系数据库,一般文件,联机事务处理记录使用数据清理和数据集成技术(1)确保命名约定、编码结构、属性度量等的一致性(2)当数据被移到数据仓库时,它们要经过转化数据仓库关键特征三——随时间而变化[4]数据仓库的时间范围比操作数据库系统要长得多(1)操作数据库系统:主要保存当前数据(2)数据仓库:从历史的角度提供信息(比如过去5-10年数据仓库的每一个关键结构都隐式或显示地包含时间元素,而操作

3、数据库中的关键结构可能就不包括时间元素数据仓库关键特征四—数据不易丢失[5]尽管数据仓库中的数据来自于操作数据库,但它们却是在物理上分离保存的操作数据库的更新不会出现在数据仓库环境下。不需要事务处理,恢复和并发控制等机制只需要两种数据访问:数据的初始转载和数据访问(读操作)数据仓库与异种数据库集成[6]传统的异种数据库集成(1)在多个异种数据库上建立包装程序(wrapper)和中介程序(mediators)(2)查询驱动方法----当从客户端传过来一个查询时,首先使用元数据字典将查询转换成相应异种数据库上的查询;然后,将这些查询映射和发送到局部查询处理器。

4、(3)缺点:复杂的信息过滤和集成处理,竟争资源数据仓库:更新驱动(1)将来自多个异种源的信息预先集成,并存储在数据仓库中,供直接查询和分析。(2)高性能数据仓库与操作数据库系统[7]操作数据库的主要任务是联机事务处理OLTP日常操作:购买,库存,银行,制造,工次,注册,记帐等数据仓库的主要任务是联机分析处理OLAP数据分析和决策数据仓库与操作数据库系统[8]OLTP和OLAP的主要区别:(1)用户和系统的面向性:顾客VS.市场(2)数据内容:当前的、详细的数据VS.历史的、汇总的数据(3)数据库设计:实体-联系模型(ER)和面向应用的数据库设计VS.星型/

5、雪花型和面向主题的数据库设计(4)视图:当前的、企业内部的数据VS.经过演化的、集成的数据(5)访问模式:事务操作VS.只读查询(但很多是复杂的查询)OLTP系统与OLAP系统的比较[9]为什么需要一个分离的数据仓库?[10]提高两个系统的性能(1)DBMS是为OLTP而设计的:存储方式,索引,并发控制,恢复(2)数据仓库是为OLAP而设计:复杂的OLAP查询,多维视图,汇总不同的功能和不同的数据(1)历史数据:决策支持需要历史数据库,而这些数据在操作数据库中一般不会去维护(2)数据汇总:决策支持需要将来自异种源的数据统一(如聚类和汇总)(3)数据质量:不

6、同的源使用不一致的数据表示、编码和格式,对这些数据进行有效的分析需要将他们转化后进行集成返回

当前文档最多预览五页,下载文档查看全文

此文档下载收益归作者所有

当前文档最多预览五页,下载文档查看全文
温馨提示:
1. 部分包含数学公式或PPT动画的文件,查看预览时可能会显示错乱或异常,文件下载后无此问题,请放心下载。
2. 本文档由用户上传,版权归属用户,天天文库负责整理代发布。如果您对本文档版权有争议请及时联系客服。
3. 下载前请仔细阅读文档内容,确认文档内容符合您的需求后进行下载,若出现内容与标题不符可向本站投诉处理。
4. 下载文档时可能由于网络波动等原因无法下载或下载错误,付费完成后未能成功下载的用户请联系客服处理。