- 17
- 0
- 约8.52千字
- 约 13页
- 2018-12-29 发布于湖北
- 举报
嵌套聚类:聚类R1={{x1,x2},{x3},{x4,x5}嵌套在聚类
R2={{x1,x2,x3},{x4,x5}}中,但并不嵌套在聚类R3={{x1,x4},{x3},
{x2,x5}}中
算法最多包含N步,在第t步,执行的操作就是在前t-1步的聚类基础上生成新聚类
我们总希望算法在得到我们期望的结果后就停止:为算法限制一个阈值,矩阵更新过程中,总是将两个距
离最近的聚类合并,那么我们只要加入一个阈值判断,当这个距离大于阈值
时,就说明不需要再合并了,此时算法结束。
聚类分析也可以作为数据挖掘算法中其他分析算法的一个预处理步骤
)HAC有很高的时空复杂性,例如,对于质心点算法(优先队列法),其时间复杂性
为:O()
用谱系图获得簇的有效性是有限的
层次聚类算法Hierarchical Clustering Algorithms
基本工作原理给定要聚类的N的对象以及N*N的距离矩阵(或者是相似性矩阵),?层次式聚类方法的基本步骤(参看S.C.?Johnson?in?1967)如下:1.?????将每个对象归为一类,?共得到N类,?每类仅包含一个对象.?类与类之间的距离就是它们所包含的对象之间的距离.2.?????找到最接近的两个类并合并成一类,?于是总的类数少了一个.3.?????重新计算新的类与所有旧类之间的距离.4.?????重复第2步和第3步,?直到最后合并成一
原创力文档

文档评论(0)