K-means算法教材课件.pptVIP

  • 57
  • 0
  • 约2.36千字
  • 约 24页
  • 2025-05-05 发布于浙江
  • 举报

K-means算法目录CONTENTS基本K-means算法01质心的指派02K-means附加问题03K-means的变种04基本K-means算法1.1K-means算法的定义聚类是一个将数据集中在某些方面相似的数据成员进行分类组织的过程,聚类就是一种发现这种内在结构的技术,聚类技术经常被称为无监督学习。k均值聚类是给定一个数据点集合和需要的聚类数目k,k由用户指定,k均值算法根据某个距离函数反复把数据分入k个聚类中。

1.2K-means算法步骤1:选择K个点作为初始质心。2:repeat3:将每个点指派到最近的质心,形成K个簇。4:重新计算每个簇的质心。5:until质心不发生变化。质心的指派2.1指派点到最近的质心为了将点指派到最近的质心,我们需要邻近性度量来量化所考虑的数据的“最近”概念。对于给定的数据类型,可能存在多种适合的邻近性度量。例如,曼哈顿距离(L)可以用于欧几里得数据。质心2.2质心和目标函数2.3选择初始质心当质心随机初始化时,K均值的不同运行将产生不同的总SSE。只要两个初始质心落在簇对的任何位置,就能得到最优聚类,因为质心将自已重新分布,每个簇一个。不幸的是,随着簇的个数增加,至少一个簇对只有一个初始质心的可能性也逐步增大。在这种情况下,由于簇对相距较远,K均值算法不能

文档评论(0)

1亿VIP精品文档

相关文档