聚类机器人与智能技术试验室合肥工业大学.ppt

聚类机器人与智能技术试验室合肥工业大学.ppt

数据挖掘技术 4. 聚类(Clustering) 聚类是把数据按照相似性归纳成若干类别,同一类中的数据彼此相似,不同类中的数据相异。 聚类是一种无监督分类法, 没有预先指定的类。 X值 聚类示例 数据挖掘技术 与分类的区别: 分类依赖于预先定义的类和带类标号的训练实例,是一种观察式 的学习;而聚类是找到这个簇的特征或者标号的过程。 一个有效的聚类算法必须满足两个条件: 类内数据对象的强相似性,通常用紧致度描述; 类间数据对象的弱相似性,常采用分离度描述。 数据挖掘技术 聚类算法的分类 聚类分析算法取决于数据的类型、聚类的目的和应用。 (1)基于划分方法 给定一个包含n个对象的数据集和要构建的划分数目k,划分方法首先创建一个初始划分,然后采用一种迭代的重定位技术,尝试通过对象在划分间的移动来改进划分 (2)基于层次方法 层次聚类是将数据集分解成几级进行聚类,层的分解可以用树形图来表示以任一样本 数据挖掘技术 (3)基于密度的方法 点为基础,当该点的给定邻域内包含的数据点个数超过某一给定阈值时,就以其邻域中的数据点为基础继续进行广度或深度探索,扩展簇的大小。

文档评论(0)

1亿VIP精品文档

相关文档