基于邻域一致性的高维小样本特征选择算法研究.pdfVIP

  • 47
  • 0
  • 约12.97万字
  • 约 64页
  • 2020-12-22 发布于江苏
  • 举报

基于邻域一致性的高维小样本特征选择算法研究.pdf

摘 要 摘 要 随着大数据技术的蓬勃发展,面向语义分析、图像识别和基因选择的应用得到广泛 普及,这些领域的数据呈现出高维小样本特点,即特征空间高维度,而样本数量过少。 高维小样本数据存在着特征维数与样本数量不协调和类别分布偏斜等问题,作为应用驱 动的本质特征,面向高维小样本的分类学习面临着计算低效、预测精度不高、无法识别 小类样本,以及模型过拟合、稳定性欠佳、存储开销大等诸多挑战。为了充分挖掘高维 小样本数据的应用价值,基于高维小样本数据的知识发现成为备受关注的研究热点。 特征选择通过删除数据特征空间中与标记无关的特征、噪声特征或冗余特征,以此 来对数据的特征空间进行降维。本文以高维小样本数据为研究对象,围绕高维小样本数 据特征选择存在的挑战性问题,重点关注真实场景中不同的应用需求,展开对监督学习 模式下的高维小样本数据特征选择算法的研究。主要研究内容包括: (1)针对由特征高维性与样本数量不协调带来的问题,提出基于子空间学习的高 维小样本数据特征选择算法。首先,利用特征扰动策略,定义基准特征和基准特征空间, 构建具有差异性的多个特征子空间。其次,提出基于子空间学习的高维小样本数据特征

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档