资源描述:
《大数据分析的时代.pdf》由会员上传分享,免费在线阅读,更多相关内容在行业资料-天天文库。
1、大数据分析的时代+当数据以成百上千TB不断增长的时候,我们需要一种独特技术来应对这种前所未有的挑战。c%全球各行各业的组织机构已经意识到,最准确的商务决策来自于事实,而不是凭空臆想。这也就意味着,他们需要在内部交易系统的历史信息之外,采用基于数据分析的决策模型和技术支持。互联网点击数据、传感数据、日志文件、具有丰富地理空间信息的移动数据和涉及网络的各类评论,成为了海量信息的多种形式。何谓大数据?5F3k;i:O2R,Q2?(G.i+H大数据,也就是国外常说的BigData。大数据概括成了三个V,即大量化(Volume)、多样
2、化(Variety)和快速化(Velocity)。这些特点也反映了大数据所潜藏的价值(Value),我们也可以认为,四个V高度概括了大数据的基本特征。业界比较一致对大数据的定义是:大数据是指无法在一定时间内用常规软件工具对其内容进行抓取、管理和处理的数据集合。极具挑战性的是,传统的数据库部署不能处理数TB数据,也不能很好的支持高级别的数据分析。在几年中,Hadoop平台和列存储数据库开启了新一轮数据分析史上的革命。而且近年来技术不断发展,我们开始看到,技术升级带来的已知架构之间的界限变得更加模糊。更为重要的是,开始逐步出现了
3、处理半结构化和非结构化信息的NoSQL等平台。大数据分析的时代本文中,我们将向大家介绍迄今为止,包括EMC的Greenplum、Hadoop和MapReduce等提供大数据分析的产品。此外,惠普前段时间收购实时分析平台Vertica数据仓库分析工具等。下面,就让我们来了解业界大数据分析的这些产品:1、模块化EMCAppliance处理多种数据类型7B%f5d!N7S'u+B8p2010年EMC收购了Greenplum,随后,利用EMC自身存储硬件和支持复制与备份功能的Greenplum大规模并行处理(MPP)数据库,推出了E
4、MCGreenplumDataComputingAppliance(DCA)。通过与SAS和MapR等合作伙伴,DCA扩大了对Greenplum的数据库支持。&