数据挖掘聚类分析.pptVIP

  • 9
  • 0
  • 约7.1千字
  • 约 36页
  • 2020-04-09 发布于湖北
  • 举报
(2)基于层次的聚类算法 层次的方法按数据分层建立簇,形成一棵以簇为节点的树。根据层次如何形成,层次的方法可以分为凝聚的和分裂的。 凝聚的方法,也称自底向上的方法,该方法从数据点作为个体簇开始,每一步合并两个最接近的簇,直到所有的簇合并为一个(层次的最上层),或者达到一个终止的条件。 分裂的方法,也称为自顶向下的方法,它与凝聚的方法正好相反,该方法从包含所有点的一个簇开始,每一步分裂一个簇,最终每个对象在单独的一个簇中,或者达到一个终止条件,比如达到某个希望的簇数目,或者两个最近的簇之间的距离超过了某个闭值。 3.聚类分析算法分类 无论是凝聚算法还是分裂算法都要采用一个划分准则,以便判定簇之间的相似性或相异性,五个广泛采用的簇间距离度量方法如下: (1)最小(单链)距离;(2)最大(全链)距离;(3)平均值(质心)距离;(4)平均(组平均)距离;(5)中心点距离。 3.聚类分析算法分类 (3)基于密度的方法 目前的研究发现基于密度的聚类方法在发现任意形状的数据集方面具有非常有力的效果。简单来说,基于密度的聚类算法就是将数据对象划分为成被低密度区分隔开的高密度区。基于密度的聚类应用本地集群准则,有非常优秀的抵抗噪声的效果,而且在挖掘任意形状的数据集方

文档评论(0)

1亿VIP精品文档

相关文档