- 8
- 0
- 约4.5千字
- 约 5页
- 2023-10-13 发布于湖北
- 举报
K-均值聚类算法
摘要 关于对生活中各种各样的数据的聚类分类问题己经成为众多学者的研究热题之一。聚类方法有很多种,其中最简单的形式便是划分式聚类,划分式聚类试图将给定的数据集合分割成不相交的子集,使具体的聚类准则是最优的。一种最流行的基于最小聚类误差平法和的聚类方法是K-均值算法。然而,K-均值算法是一个局部搜索的算法,它存在一些严重的不足,比如K值需要预先确定、聚类结果的好坏依赖于初始点的选取。本文对聚类进行了简单的介绍,并对K-均值算法进行了研究分析。
关键词 数据挖掘;聚类分析;K-均值聚类算法
1.引言
在因特网无处不在的今天,人们所面临的形形色色的数据量呈急速增长状态。然而,在数据如此海量的同时,人们却缺乏对这些数据中所隐含的信息或知识的充分理解。在这种需求情况下,数据挖掘技术应运而生。
聚类分析作为数据挖掘在实际应用中的主要任务之一,是数据挖掘中一个很活跃的研究领域,与其他学科的研究方向具有很好的的交叉性。在识别数据内部结构方面具有极其重要的作用。
K-均值聚类算法是聚类分析中的一种基本划分式方法。由于其算法简便易懂,且在计算速度上具有无可比拟的优势,通常被作为大样本聚类分析的首选方案。
2.数据挖掘中聚类分析算法的相关介绍
聚类分析是多元统计分析方法中的一种,是非监督模式识别的一个重要分支。所谓聚类就是按照事物的某些属性,把事物聚集成簇,使簇内的对象之间具有较高
原创力文档

文档评论(0)