欢迎来到天天文库
浏览记录
ID:26247688
大小:355.06 KB
页数:10页
时间:2018-11-25
《数据仓库与数据挖掘论文》由会员上传分享,免费在线阅读,更多相关内容在工程资料-天天文库。
1、《数据仓库与数据挖掘》论文题目:浅析基于数据仓库与数据挖掘技术的决策支持系统指导老师:班级:学号:姓名:专业:2012年11月2日摘要通过对数据仓库与数据挖掘的学习和大致的了解,主要提出了一种基于数据仓库的数据挖掘系统的决策支持系统的框架。该文章把数据仓库、数据挖掘工具和知识库结合在一起,提高了数据挖掘的效率。增加了挖掘数据的效率和价值实用性!一、概述今天,越来越多的企业认识到要从以往的事务处理和决策中总结经验,利用现有的数据进行分析和推理,建立企业的决策支持系统(DSS)以提高决策的质量。企业如果不能快速精确的收集和分析信息,将无法进行科学而有效的决策。建立数据仓库(Datawareh
2、ouse)将能很的解决这一问题,使企业从大量的业务信息中筛选出所需的信息,并做出正确的决策。数据仓库不是单一的产品,而是综合了多种信息技术的计算环境。它将全企业的运行数据汇集到一个精心设计的关系数据库中,并将它们转换成面向主题(Subject-oriented)的形式,使最终用户很容易的从历史的角度对这些数据进行访问和分析。以银行为例,通常,银行的应用系统是按业务分类的,如储蓄、信贷、信用卡等,一个客户的信息分布在不同的业务系统中,要想得到一个客户的全面信息非常困难。银行通过建立数据仓库,可以将分离在各个业务系统中的数据合并成一个统一的图表,这样就可以看到客户在各个系统中的全貌,而且可以
3、从历史的角度对客户档案进行分析,以便做出为每一个客户进一步服务的决策。二、数据仓库和数据挖掘的基本概念数据仓库是支持管理决策过程的、面向主题的、集成的、随时间而变的、持久的数据集合。数据仓库系统负责从操作型数据库中抽取数据,实现对集成和综合后的数据的管理,并把数据呈现给一组数据仓库前端工具,以满足用户的各种分析和决策的需求。数据仓库系统的前端工具以OLAP工具和数据挖掘工具为代表,是用户赖以从数据仓库中提取、分析数据,以及实施决策的必经途径。数据挖掘DM(DataMining),是指从数据中识别出潜在有用的、先前未知的、最终可理解的模式的非平凡过程。研究基于数据仓库的数据挖掘系统结构框架
4、是很有意义的。三、数据仓库的结构、功能1、数据仓库的基本结构数据仓库中的信息存储,根据对数据的不同深度的分析处理而区分为不同的层次,其基本结构分为以下几个部分:(1)历史性详细数据层:它存储历史数据,用于数据对比、回归、汇总等供分析、建模预测之用。历史数据一般为5至10年或更久的数据,它纵向只对数据/信息进行分类存储。(2)当前详细数据层:存储当前最新详细数据,重点用于了解当前情况,是进一步分析数据的基础。在一定时刻,这些数据会转移到历史数据层去。(3)不同程序的归纳总结信息层:可包含多个层次,根据所需分类和归纳的不同深度而定。如按周、月、年统计的数据。这些信息只是一些简单的汇总,尚不能
5、形成高级的决策信息。(4)专业信息分析层:进一步专业分析的结果,如统计分析、运筹分析、时间序列分析以及表面数据的内在规律分析等。(5)仓库结构信息:数据仓库的内部结构信息,反映各种信息在数据仓库中的位置分布和处理方式等,以便检索查询之用。组织数据仓库的数据时,应根据数据访问概率把数据分为经常被访问但较少被修改的数据和经常被修改但较少被访问的数据。对于前者可以做较多的索引(一般可做8至12个)来提高访问的效率;对于后者就必须少建索引,否则,由于它经常被修改,重索引的概率就很大,反而会降低系统的效率。2、数据仓库的功能特点数据仓库的主要功能是提供企业决策支持系统或执行信息系统(EIS)所需要
6、的信息,它把企业日常运行中分散不一致的数据经归纳整理后转换为集中统一的、可随时取用的深层信息,这种信息虽然也是按关系数据库的存储结构存储的,单与面向逐条记录的联机时务处理(OLTP)不同,在数据仓库中的一条记录,有可能是基础数据中若干个表、若干条记录的归纳和汇总。数据仓库的基本特点是:(1)面向对象性。数据仓库中存储的信息是面向主题来组织的。它根据所需要的信息,分不同类、不同角度等主题把数据加工、整理之后存储起来(按横向对数据进行分类存储)。(2)数据历史性。数据仓库中可以专门存储5至10年或更久的历史数据,数据具有时间标示,以满足信息比较、分析预测等的数据需求(按纵向对数据进行分类存储
7、)。(3)数据集成性。无论数据来源于何处,进入数据仓库后都具有统一的数据结构和编码规则,数据仓库中的数据具有一致性的特点。(4)数据只读性。数据仓库是一个信息源,它只是为在其上开发的DSS或EIS等提供信息服务,因此它应是只读数据库,一般不能轻易改动,只能定期刷新。(5)操作集合性。数据仓库可通过快照机制,成批的更新来自不同资源的数据,将其载入数据仓库;也可以成批的访问数据。(6)应用C/S(客户机/服务器)性。数据仓库通过定义信息
此文档下载收益归作者所有