pentaho工具使用手册.doc

pentaho工具使用手册.doc

ID:20553010

大小:3.10 MB

页数:33页

时间:2018-10-10

pentaho工具使用手册.doc_第1页
pentaho工具使用手册.doc_第2页
pentaho工具使用手册.doc_第3页
pentaho工具使用手册.doc_第4页
pentaho工具使用手册.doc_第5页
资源描述:

《pentaho工具使用手册.doc》由会员上传分享,免费在线阅读,更多相关内容在教育资源-天天文库

1、Pentaho工具使用手册作者:马腾,李洪宇版本:1.0目录BI介绍2Pentaho产品介绍3Pentaho产品线设计4PentahoBIPlatform安装4PentahoDataIntegration-------Kettle8PentahoReportDesigner12Saiku23SchemaWorkbench27附件32BI介绍1.BI基础介绍BI(BusinessIntelligence)即商务智能,它是一套完整的解决方案,利用数据仓库、数据挖掘技术对客户数据进行系统地储存和管理,并通过各种数据统计分析工具对客户数据进行分析,提供各种分析报告,为企业的各种经营

2、活动提供决策信息。其中的关键点是数据管理,数据分析,支持决策。根据要解决问题的不同,BI系统的产出一般包括以下三种:2.BI系统的产出2.1固定格式报表固定格式报表是BI最基本的一种应用,其目的是展示当前业务系统的运行状态。固定格式报表一旦建立,用户就不可以更改报表的结构,只能依据数据库的数据不断刷新报表,以便取得较新的数据。在pentaho产品线中,我们使用pentahoreportdesigner来实现固定格式报表的需求。2.2OLAP分析OLAP分析是指创建一种动态的报表展示结构,用户可以在一个IT预定义的数据集中自由选择自己感兴趣的特性和指标,运用钻取,行列转换等分

3、析手段实现得到知识,或者验证假设的目的。在pentaho产品线中,我们使用Saiku来实现OLAP分析的需求。2.3数据挖掘数据挖掘是BI的一种高级应用。数据挖掘是指从海量数据中通过数据挖掘技术得到有用的知识,并且以通俗易懂的方式表达知识,以便支持业务决策。在pentaho产品线中,我们使用weka来实现数据挖掘的需求。Pentaho产品介绍1.产品介绍Pentaho是世界上最流行的开源商业智能软件,以工作流为核心的、强调面向解决方案而非工具组件的BI套件,整合了多个开源项目,目标是和商业BI相抗衡。它是一个基于java平台的商业智能套件,之所以说是套件是因为它包括一个we

4、bserver平台和多个工具软件:报表,分析,图表,数据集成,数据挖掘等,可以说包括了商业智能的方方面面。2.Pentaho架构图Pentaho的架构图如下,简要解释如下:3rdpartyapplications指交易系统,也就是数据仓库的原系统。Data&ApplicationIntegration主要指定义数据仓库的元数据,在数据仓库结构设计完毕后,通过ETL过程将原系统数据送入数据仓库。BusinessIntelligencePlatform指pentaho提供的BI平台,在这个平台上可以进行平台安全设置,平台管理之类的工作,这个平台也是BI服务的基础。Reporti

5、ng,Analysis,Dashboards,ProcessManagement是基于BI平台上Pentaho可以实现的服务,比如报表,分析,仪表盘,服务自动控制等。PresentationLayer指展示层,在这一层,我们可以把其下层做好的报表等分析结果通过门户网站,Email等各种方式展示给用户。Pentaho产品线设计1.产品线设计Pentaho作为一个开源的BI套件,商业版与社区版加起来共有几十种产品。考虑到恒信实际业务开展的情况,以及未来可能的需求,确定产品线如下。BIFunctionProductETLKettleMetadataManagementPentah

6、oMetadataEditor(PME)OLAPSaiku+SchemaWorkbenchReporttoolsFixedreport:PentahoreportdesignerAd-hocreport:SaikuDashboard:CDEDataMiningWekaBIplatformPentahoBIPlatformRlanguageRBigDataPentahoforBigData产品线的设计并非一成不变,随着需求的增加,当某些需求无法利用现有的产品线实现时,可以继续添加组件,以便形成更为完善的BI体系。PentahoBIPlatform安装1.安装步骤将下载下来的b

7、iserver-ce-X.X.X-stable.zip文件解压到D:下,将会产生administration-console和biserver-ce两个文件夹,前者是pentaho控制台,后者是pentahoBI服务器。默认时,PentahoBI平台会使用内置的JRE,它位于D:biserver-cejre位置。如果用户机器上安装了JDK,并设置了JAVA_HOME,则PentahoBI平台会使用用户指定的JDK。运行D:biserver-ce>下的“start-pentaho.bat”批处理脚本能够启动P

当前文档最多预览五页,下载文档查看全文

此文档下载收益归作者所有

当前文档最多预览五页,下载文档查看全文
温馨提示:
1. 部分包含数学公式或PPT动画的文件,查看预览时可能会显示错乱或异常,文件下载后无此问题,请放心下载。
2. 本文档由用户上传,版权归属用户,天天文库负责整理代发布。如果您对本文档版权有争议请及时联系客服。
3. 下载前请仔细阅读文档内容,确认文档内容符合您的需求后进行下载,若出现内容与标题不符可向本站投诉处理。
4. 下载文档时可能由于网络波动等原因无法下载或下载错误,付费完成后未能成功下载的用户请联系客服处理。