第十讲__聚类分析(安徽农大徐建新版).pptVIP

  • 9
  • 0
  • 约8.55千字
  • 约 20页
  • 2018-03-23 发布于河南
  • 举报

第十讲__聚类分析(安徽农大徐建新版).ppt

第十讲__聚类分析(安徽农大徐建新版)

第十讲 聚类分析 CLUSTER ANALYSIS 第三节 相似系数的含义 第四节 系统聚类方法(Hierarchical Clustering Method) 一、系统聚类方法的基本思想 从一批样品的多个观测指标(变量)中,找出能度量样品间相似程度的统计 量,以这些统计量作为划分类型的依据,把一些相似程度较大的样品聚为一类, 另外一些彼此之间相似程度较大的样品聚合为另外一类,……。关系密切的聚合 到一个小的分类单位,关系疏远的聚合到一个大的分类单位,直到把所有的样品 都聚合完毕,把不同的类型一一划分出来,形成一个由小到大的分类系统,最后 再把整个分类系统画成一张分群图(又称谱系图),用它把所有样品间的亲疏关 系表示出来。 二、系统聚类方法的分析思路 先将每一个样品各自看成一类,然后定义样品间的距离(或相似系数)和类与 类间的距离。聚类过程是首先选择距离最小的两类将其合并成一新类(如果样品 间关系采用相似系数,则应选择相似系数绝对值最大的两类首先合并),再按类 间距离的定义,计算新类与其它类间的距离,再将距离最近两类合并,如此继 续,这样每次减少一类,直至所有样品都聚为一类为止。 三、系统聚类的方法 类与类间的距离有多种定义方法,例如可以定义两类间的距离为两类样品间的 最近距离,或者定义为两类样品间的最远距离等

文档评论(0)

1亿VIP精品文档

相关文档