数据挖掘原理与应用(第2版)课件:k-近邻分类.pptx

数据挖掘原理与应用(第2版)课件:k-近邻分类.pptx

k-近邻分类

K-近邻分类

K-近邻(K-NearestNeighbor,KNN)分类算法,最初是由Cover和Hart于1968年提出,是一个理论上比较成熟的方法。

算法原理简单直观:

未知样本的类别,由特征空间中K个最相似(即特征空间中最邻近)的样本的大多数类别来确定。

是一种基于实例的懒惰学习方法。

K-近邻分类

K-近邻分类

算法的处理过程为:

对于待预测的未分类样本,计算其与数据集中每个样本之间的相似度;

筛选出最近邻的K个数据样本;

根据K个最近邻数据样本的类别,采用多数投票机制确定待预测样本的类别。

K-近邻分类

这里有几个问题需要详细讨论:

以何种指标来衡量数据样本之间的相似

文档评论(0)

1亿VIP精品文档

相关文档