基于聚类和类重叠分析的近邻分类-计算机系统应用.PDF

基于聚类和类重叠分析的近邻分类-计算机系统应用.PDF

2015 年 第 24 卷 第 9 期 计 算 机 系 统 应 用 基于聚类和类重叠分析的近邻分类① 刘杜钢 (福建师范大学 数学与计算机科学学院, 福州 350100) 摘 要: k 近邻分类(kNN)是一种简单而有效的非参数分类算法, 但存在着参数需要人工确定, 没有显式构建分类 模型造成存储空间大、分类效率低, 且易受到“维灾”效应影响等缺点. 针对这些缺点, 提出一种高效的近邻分类 新方法, 构造了两个新的近邻分类器. 新方法使用由 K 均值聚类产生的优化的簇原型集合为分类模型, 减少了存 储空间的同时提高了分类效率; 提出三种类重叠分析策略并引入模糊基准度量以减轻维灾影响. 以该分类模型 学习方法为基础, 提出一种新的kNN 分类器和组合朴素贝叶斯的新分类器, 算法涉及的参数都可以自动确定. 在 人工和现实数据集上进行的实验表明, 新分类器具有良好的分类效率和分类准确率. 关键词: 近邻分类; K 均值聚类; 簇原型; 类重叠分析; 模糊基准度量 Neighbor Classification Based on Clustering and Class

文档评论(0)

1亿VIP精品文档

相关文档