- 7
- 0
- 约2.28千字
- 约 6页
- 2021-12-05 发布于江苏
- 举报
概述:
KMEANS 算法又被成为K 均值算法,是一种常用的聚类算法,由于不需要根据 给定的训练集训练模型因此是一种无监督学习算法。其本质是根据选定的参数 K 将数据分类成K 类,在聚类过程中从单一样本开始通过不断计算聚类数据的 均值来作为整个类的中心进而再将距离此类别中心最近的数据纳入同一类。
算法原理:
1、以下图样本散点图展示数据集的整体分布情况
2、K 值是KMEANS 最重要的选择参数,直接决定着数据聚类的类别数量,在 选择K 值后,会在数据中随机选择 K 个数据样本最为初始中心点,如 K=3 ,则
■结果如下图所示
■
3、计算和中心点距离最近的点,将其归入同类
4、每个类别当有了
原创力文档

文档评论(0)