- 8
- 0
- 约7.04千字
- 约 31页
- 2019-11-11 发布于湖北
- 举报
STING:统计信息网格 优点如下: 计算是独立于查询的; 有利于并行处理和增量更新; 效率很高。 STING算法扫描数据库一次来计算单元的统计信息,因此产生聚类的时间复杂度是o(n),其中n是对象的数目。在层次结构建立后,查询处理时间是,这里g是最低层网格单元的数目o(g),通常远小于n。 * STING:统计信息网格 缺点如下: 如果粒度比较细,处理的代价会显著增加;但是,如果网格结构最低层的粒度太粗,将会降低聚类分析的质量; 在构建一个父亲单元时没有考虑孩子单元和其相邻单元之间的关系,因此,结果簇的形状是isothetic,即所有的聚类边界或者是水平的,或者是竖直的,没有斜的分界线。 尽管该技术有快速的处理速度,但可能降低簇的质量和精确性 * CLIQUE :一种类似于Apriori的子空间聚类方法 CLICQUE算法是基于网格的空间聚类算法,但它同时非常好地结 合了基于密度的聚类算法思想,因此既可以像基于密度的方法发现任意形状的簇,又可以像基于网格的方法处理较大的多维数据集。 CLIQUE把每个维划分成不重叠的区间,从而把数据对象的整个嵌入空间划分成单元。它使用一个密度阀值识别稠密单元,一个单元是稠密的,如果映射到它的对象超过该密度阀值 * CLIQUE :一种类似于Apriori的子空间聚类方法 算法概述: 算法需要两个参数值,一个是网格的步长,
原创力文档

文档评论(0)