《机器学习Python实战》课件 18-项目9 k 均值聚类算法基本原理讲解.pptxVIP

  • 1
  • 0
  • 约1.8千字
  • 约 17页
  • 2026-09-03 发布于山东
  • 举报

《机器学习Python实战》课件 18-项目9 k 均值聚类算法基本原理讲解.pptx

?机器学习Python实战?项目9k均值聚类算法

1K均值聚类算法原理2k均值聚类算法标准流程目录CONTENTS3k均值聚类算法参数选择

01k均值聚类算法原理

什么是聚类算法?聚类算法是一种无监督学习方法,将无标签数据划分为若干个簇(cluster),使得同一簇内样本相似度高,不同簇间相似度低。与分类不同,聚类不依赖预先定义的类别标签。图9-1原始数据图9-2聚类结果

聚类的核心逻辑——相似性度量聚类算法基于样本之间的距离(即相似性)进行划分,将距离近(相似度高)的样本归入同一簇,距离远(相似度低)的样本归入不同簇。最终目标是:簇内紧密(高内聚),簇间疏远(低耦合)。

k均值聚类算法定义K-Means(K均值)聚类算法:给定一个包含n个样本的数据集,以及用户预先指定的聚类数目k,算法以样本间的距离(通常为欧氏距离)为度量,通过反复迭代优化,将数据划分为k个簇,使得每个样本与其所属簇中心的距离平方和最小。

k均值聚类算法迭代过程待聚类样本(目标k=3)随机初始化3个质心将每个样本分配到距离最近的质心,形成3个簇。判断:样本归属是否发生变化?否→算法终止;是→继续迭代。对每个簇,重新计算其所有样本的均值,将质心更新为均值位置。再次计算每个簇的样本均值,更新质心位置。重新分配样本到最近质心,更新簇划分。判断:样本

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档