- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
空间数据挖掘:变数据为知识
■ 中国科学院计算技术研究所 刘毅勇 何雄 李金山 廖浩均 孟亮 邓柱中
空间数据挖掘(spatial data mining)是在数据挖掘的基础之上,结合地理信息系统(GIS)、遥感图像处理、全球定位系统(GPS)、模式识别、可视化等相关的研究领域而形成的一个分支学科,也称为空间数据挖掘和知识发现(spatial data mining and knowledge discovery 简称为SDMKD)。
自20世纪60年代数据库系统诞生以来,数据库技术已经得到了飞速的发展,并且己经深入到社会生活的各个方面。现在,数据无处不在,可以存放在不同类型的数据库中,数据仓库技术可以将异构的数据库集成起来进行综合管理,从而提供更好的服务。
但是,随着科学技术的进步,新的数据采集和获取技术不断发展,使得数据库中所存储的数据量也随之急剧增长。另一方面,数据处理技术的发展却相对落后,数据库技术仍然停留在相对简单的录入、查询、统计、检索阶段,对数据库中的数据之间存在的关系和规则、数据的群体特征、数据集内部蕴涵的规律和趋势等,却缺少有效的技术手段将其提取出来,从而出现所谓的“被数据淹没,却饥渴于知识”(John Naisbett,1997)的现象。
在空间信息方面我们的处境甚至更加严峻。随着人类科学技术的飞速发展,雷达、红外、光电、卫星、电视摄像、电子显微成像等各种技术和手段被广泛应用于空间信息的生成和采集,加上先进的空间信息制作技术和发布技术的应用,导致了空间信息数据的爆炸性增长。而另一方面,人类处理这些海量信息并从中挖掘有用的知识的技术和手段相对而言却非常贫乏和软弱,使我们迷失在空间信息和数据的汪洋大海之中饱受空间知识匮乏之苦。
为了解决这种“被数据淹没,却饥渴于知识”的现象,科学家们于20世纪80年代末期创立了一个新的研究领域,即数据挖掘(Data Mining),或称数据挖掘和知识发现(Data Mining and Knowledge Discovery, 简称为DMKD)。这是在数据库技术、机器学习、人工智能、统计分析等基础上发展起来的一个交叉性的学科。区别于简单地从数据库管理系统检索和查询信息,数据挖掘是指“从数据中发现隐含的、先前不知道的、潜在有用的信息的非平凡过程” (Frawley, 1991),其目的是把大量的原始数据转换成有价值的、便于利用的知识。
自从数据挖掘和知识发现的概念于1989年8月首次出现在第11届国际联合人工智能学术会议以来,数据挖掘和知识发现领域的研究和应用均得到了长足的发展,形成了一些行之有效的理论和方法,并逐渐成为计算机信息处理领域的研究热点。
随着空间信息的爆炸性增长与空间知识贫乏的矛盾日益突出,以及数据挖掘研究领域如火如荼的发展,使得空间数据挖掘这一门新兴学科应运而生。
空间数据挖掘和知识发现这一学科起源于国际GIS会议。1994年,我国学者李德仁院士在加拿大渥太华举行的GIS国际学术会议上提出了从GIS数据库中发现知识的概念,并系统分析了空间知识发现的特点和方法。目前空间数据挖掘己成为国际研究的一个热点,渗透到数据挖掘和知识发现、地球空间信息学和一些综合性的学术活动中,成为众多著名国际学术会议的重要研究专题。由于有了数据挖掘的研究成果作为其坚实的基础,空间数据挖掘这一学科的发展更加迅猛,同样由于空间信息独特的复杂性,也使得空间数据挖掘的研究更加艰难,因而更加富有挑战性。
空间数据挖掘是指从空间数据库中抽取没有清楚表现出来的隐含的知识和空间关系,并发现其中有用的特征和模式的理论、方法和技术。
严格地说,这一学科采用空间数据挖掘和知识发现(SDMKD)这一名称更为确切。事实上,空间数据挖掘和知识发现的过程大致可分为以下多个步骤:数据准备、数据选择、数据预处理、数据缩减或者数据变换、确定数据挖掘目标、确定知识发现算法、数据挖掘、模式解释、知识评价等,而数据挖掘只是其中的一个关键步骤。但是为了简便,人们常常用空间数据挖掘来代替空间数据挖掘和知识发现。
空间数据的特点
空间数据挖掘是数据挖掘学科的一个重要分支,但它与普遍意义上的数据挖掘又有很大的差别,这是由空间数据固有的特点及其复杂性所决定的。
空间数据与其他类型数据的本质区别是其空间属性。空间属性包括空间位置、距离、几何形状、大小等内容,并且可引伸为空间个体之间的相互关系,如拓扑关系、方位关系、度量关系等,从而使得空间数据比其他类型的数据要更为复杂,主要表现在:空间属性之间的非线性关系;空间数据的多尺度特征,即空间数据在不同观察层次上所遵循的规律以及所体现出的特征不尽相同;空间信息的不确定性,空间位置、空间相关性及其他属性均可能存在不确定性;空间数据属性空间的高维数,与空间数据相关联的可能很多(如遥感传感器波段的数目可能
文档评论(0)