欢迎来到天天文库
浏览记录
ID:47517998
大小:95.00 KB
页数:10页
时间:2020-01-12
《数据挖掘论文 数据挖掘分类方法及其应用》由会员上传分享,免费在线阅读,更多相关内容在行业资料-天天文库。
1、《数据挖掘论文》数据挖掘分类方法及其应用课程名称:数据挖掘概念与技术姓名学号:指导教师:10数据挖掘分类方法及其应用作者:来煜摘要:社会的发展进入了网络信息时代,各种形式的数据海量产生,在这些数据的背后隐藏这许多重要的信息,如何从这些数据中找出某种规律,发现有用信息,越来越受到关注。为了适应信息处理新需求和社会发展各方面的迫切需要而发展起来一种新的信息分析技术,这种局势称为数据挖掘。分类技术是数据挖掘中应用领域极其广泛的重要技术之一。各种分类算法有其自身的优劣,适合于不同的领域。目前随着新技术和新领域的不断出现,对分类
2、方法提出了新的要求。。关键字:数据挖掘;分类方法;数据分析Abstract:Thedevelopmentofthesocietyenteredthenetworkinformationage,massproducevariousformsofdata,hiddenbehindthedatathatanumberofimportantinformation,howtofindoutsomerulefromthesedata,findusefulinformation,moreandmoreattention.Inorde
3、rtomeetthenewdemandinformationprocessingandtheurgentneedsofthesocialdevelopmentinallaspectsanddevelopedanewkindofinformationanalysistechnology,thissituationiscalleddatamining.Classificationtechniqueiswidelyappliedindataminingfieldofoneoftheimportanttechnology.Al
4、lkindsofclassificationalgorithmhasitsownadvantagesanddisadvantages,andsuitablefordifferentfields.Nowwiththenewtechnologyandnewfieldsappearconstantly,putsforwardnewrequirementsforclassificationmethod.Keywords:datamining;Classificationmethod;Dataanalysis10l引言数据是知识
5、的源泉。但是,拥有大量的数据与拥有许多有用的知识完全是两回事。过去几年中,从数据库中发现知识这一领域发展的很快。广阔的市场和研究利益促使这一领域的飞速发展。计算机技术和数据收集技术的进步使人们可以从更加广泛的范围和几年前不可想象的速度收集和存储信息。收集数据是为了得到信息,然而大量的数据本身并不意味信息。尽管现代的数据库技术使我们很容易存储大量的数据流,但现在还没有一种成熟的技术帮助我们分析、理解并使数据以可理解的信息表示出来。在过去,我们常用的知识获取方法是由知识工程师把专家经验知识经过分析、筛选、比较、综合、再提取
6、出知识和规则。然而,由于知识工程师所拥有知识的有局限性,所以对于获得知识的可信度就应该打个折扣。目前,传统的知识获取技术面对巨型数据仓库无能为力,数据挖掘技术就应运而生。数据的迅速增加与数据分析方法的滞后之间的矛盾越来越突出,人们希望在对已有的大量数据分析的基础上进行科学研究、商业决策或者企业管理,但是目前所拥有的数据分析工具很难对数据进行深层次的处理,使得人们只能望“数”兴叹。数据挖掘正是为了解决传统分析方法的不足,并针对大规模数据的分析处理而出现的。数据挖掘通过在大量数据的基础上对各种学习算法的训练,得到数据对象间
7、的关系模式,这些模式反映了数据的内在特性,是对数据包含信息的更高层次的抽象。目前,在需要处理大数据量的科研领域中,数据挖掘受到越来越多的关注,同时,在实际问题中,大量成功运用数据挖掘的实例说明了数据挖掘对科学研究具有很大的促进作用。数据挖掘可以帮助人们对大规模数据进行高效的分析处理,以节约时间,将更多的精力投入到更高层的研究中,从而提高科研工作的效率。分类技术是数据挖掘中应用领域极其广泛的重要技术之一。至今已提出了多种分类算法,主要有决策树、关联规则、神经网络、支持向量机和贝叶斯、k-临近法、遗传算法、粗糙集以及模糊逻
8、辑技术等。大部分技术都是使用学习算法确定分类模型,拟合输入数据中样本类别和属性集之间的联系,预测未知样本的类别。训练算法的主要目标是建立具有好的泛化能力的模型,该模型能够准确地预测未知样本的类别。1.数据挖掘概述数据挖掘又称数据库中的知识发现,是目前人工智能和数据库领域研究的热点问题,所谓数据挖掘是指从数据库的大量数据中揭示出隐含
此文档下载收益归作者所有