东软商务智能数据挖掘考试题库

东软商务智能数据挖掘考试题库

ID:24191633

大小:60.51 KB

页数:4页

时间:2018-11-13

东软商务智能数据挖掘考试题库_第1页
东软商务智能数据挖掘考试题库_第2页
东软商务智能数据挖掘考试题库_第3页
东软商务智能数据挖掘考试题库_第4页
资源描述:

《东软商务智能数据挖掘考试题库》由会员上传分享,免费在线阅读,更多相关内容在教育资源-天天文库

1、商务智能复习题一、名词解释1.数据仓库:是一种新的数据处理体系结构,是面向主题的、集成的、不可更新的(稳定性)、随时间不断变化(不同时间)的数据集合,为企业决策支持系统提供所需的集成信息。2.OLAP:OLAP是在OLTP的基础上发展起来的,以数据仓库为基础的数据分析处理,是共享多维信息的快速分析,是被专门设计用于支持复杂的分析操作,侧重对分析人员和高层管理人员的决策支持。3.粒度:指数据仓库的数据单位中保存数据细化或综合程度的级别。粒度影响存放在数据仓库中的数据量的大小,同时影响数据仓库所能回答查询问题的细节程度。4.数据挖掘:从大量的、不完全的、有噪声的、

2、模糊的、随机的数据中,提取隐含在其中的、人们事先不知道的、但又是潜在有用的信息和知识的过程。5.OLTP:OLTP为联机事务处理的缩写,OLAP是联机分析处理的缩写。前者是以数据库为基础的,面对的是操作人员和低层管理人员,对基本数据进行查询和增、删、改等处理。6.ROLAP:是基于关系数据库存储方式的,在这种结构中,多维数据被映像成二维关系表,通常采用星型或雪花型架构,由一个事实表和多个维度表构成。7.聚类:是将物理或抽象对象的集合分组成为多个类或簇(cluster)的过程,使得在同一个簇中的对象之间具有较高的相似度,而不同簇中的对象差别较大。8.决策树:是用

3、样本的属性作为结点,用属性的取值作为分支的树结构。它是分类规则挖掘的典型方法,可用于对新样本进行分类。9.频繁项集:指满足最小支持度的项集,是挖掘关联规则的基本条件之一。10.支持度:规则A→B的支持度指的是所有事件中A与B同地发生的的概率,即P(A∪B),是AB同时发生的次数与事件总次数之比。支持度是对关联规则重要性的衡量。11.可信度:规则A→B的可信度指的是包含A项集的同时也包含B项集的条件概率P(B

4、A),是AB同时发生的次数与A发生的所有次数之比。可信度是对关联规则的准确度的衡量。12.关联规则:同时满足最小支持度阈值和最小可信度阈值的规则称之为关联

5、规则。二、综合题1.何谓数据挖掘?它有哪些方面的功能?数据挖掘的功能包括:概念描述、关联分析、分类与预测、聚类分析、趋势分析、孤立点分析以及偏差分析等。2.何谓数据仓库?为什么要建立数据仓库?4数据仓库是一种新的数据处理体系结构,是面向主题的、集成的、不可更新的(稳定性)、随时间不断变化(不同时间)的数据集合1.列举操作型数据与分析型数据的主要区别。操作型数据分析型数据当前的、细节的历史的、综合的面向应用、事务驱动面向分析、分析驱动频繁增、删、改几乎不更新,定期追加操作需求事先知道分析需求事先不知道生命周期符合SDLC完全不同的生命周期对性能要求高对性能要求宽

6、松一次操作数据量小一次操作数据量大支持日常事务操作支持管理决策需求2.何谓OLTP和OLAP?它们的主要异同有哪些?OLTP即联机事务处理,是以传统数据库为基础、面向操作人员和低层管理人员、对基本数据进行查询和增、删、改等的日常事务处理。OLAP即联机分析处理,是在OLTP基础上发展起来的、以数据仓库基础上的、面向高层管理人员和专业分析人员、为企业决策支持服务。OLTP和OLAP的主要区别如下表:OLTPOLAP数据库数据数据库或数据仓库数据细节性数据综合性数据当前数据历史数据经常更新不更新,但周期性刷新一次性处理的数据量小一次处理的数据量大对响应时间要求高响

7、应时间合理用户数量大用户数据相对较少面向操作人员,支持日常操作面向决策人员,支持管理需要面向应用,事务驱动面向分析,分析驱动3.何谓粒度?它对数据仓库有什么影响?按粒度组织数据的方式有哪些?粒度是指数据仓库的数据单位中保存数据细化或综合程度的级别。粒度影响存放在数据仓库中的数据量的大小,同时影响数据仓库所能回答查询问题的细节程度。4.简述数据仓库设计的三级模型及其基本内容。概念模型设计是在较高的抽象层次上的设计,其主要内容包括:界定系统边界和确定主要的主题域。逻辑模型设计的主要内容包括:分析主题域、确定粒度层次划分、确定数据分割策略、定义关系模式、定义记录系统

8、。物理数据模型设计4的主要内容包括:确定数据存储结构、确定数据存放位置、确定存储分配以及确定索引策略等。提高性能的主要措施有划分粒度、数据分割、合并表、建立数据序列、引入冗余、生成导出数据、建立广义索引等。1.在数据挖掘之前为什么要对原始数据进行预处理?原始业务数据来自多个数据库或数据仓库,它们的结构和规则可能是不同的,这将导致原始数据非常的杂乱、不可用,即使在同一个数据库中,也可能存在重复的和不完整的数据信息,为了使这些数据能够符合数据挖掘的要求,提高效率和得到清晰的结果,必须进行数据的预处理。为数据挖掘算法提供完整、干净、准确、有针对性的数据,减少算法的计

9、算量,提高挖掘效率和准确程度。2.简述

当前文档最多预览五页,下载文档查看全文

此文档下载收益归作者所有

当前文档最多预览五页,下载文档查看全文
温馨提示:
1. 部分包含数学公式或PPT动画的文件,查看预览时可能会显示错乱或异常,文件下载后无此问题,请放心下载。
2. 本文档由用户上传,版权归属用户,天天文库负责整理代发布。如果您对本文档版权有争议请及时联系客服。
3. 下载前请仔细阅读文档内容,确认文档内容符合您的需求后进行下载,若出现内容与标题不符可向本站投诉处理。
4. 下载文档时可能由于网络波动等原因无法下载或下载错误,付费完成后未能成功下载的用户请联系客服处理。