聚类分析综述教学课件.ppt

* 聚类综述 * 蝴蝶型数据集 * * 聚类中心 * 聚类综述 * * 聚类综述 * K-Means的进一步应用 K-Means的分类结果并不保证有实际的价值,通常需要其它手段来解释,如: A)把类别作为目标变量建立一个决策树,并用它产生一些规则解释说明如何把新的样品正确的归类; B)使用可视化的方法研究这些类别如何受输入变量变化的影响; C)检查一类到另一类变量分布的差异,每一次一个变量。 * 聚类综述 * 基于密度的聚类方法 基于密度的方法与其它方法的一个根本区别是:它不是基于各种各样的距离的,而是基于密度的 这样就能克服基于距离的算法只能发现“类圆形”的聚类的缺点 * 聚类综述 * 基于网格的聚类方法 这种方法首先将数据空间划分成为有限个单元(Cell)的网格结构,所有的处理都是以单个的单元为对象的 这么处理的一个突出的优点就是处理速度很快 * 聚类综述 * 基于模型的聚类方法 基于模型的方法给每一个聚类假定一个模型,然后去寻找能个很好的满足这个模型的数据集 它的一个潜在的假定就是:目标数据集是由一系列的概率分布所决定的 9种车如何分类? 按照重量和最高速度来分类 图中的术语 计算机如何辨识这些分类? 已知数据的情况下,如何找到某一类的更一般的特征(聚类中心)?如何找到聚类的中心点? K-MEANS有其缺点:产生类的大小相差不会很大,对于脏数据很敏感。 k—med

文档评论(0)

1亿VIP精品文档

相关文档