- 0
- 0
- 约9.64千字
- 约 19页
- 2026-08-15 发布于上海
- 举报
机器学习特征选择方法对比研究
一、引言
随着数据采集与存储技术的快速发展,各领域积累的数据规模呈爆炸式增长,数据的维度也不断提升,从传统的几十、上百维特征,发展到如今文本、生物信息、多模态数据中动辄上万乃至数十万维的高维特征。高维数据在带来更丰富信息的同时,也引发了“维度灾难”问题,也就是随着特征维度的增加,模型的训练成本急剧上升,泛化能力反而下降,同时模型的可解释性也大幅降低(科沃杰伊奇克,2019)。为了解决这一问题,特征选择作为数据预处理阶段的核心环节,受到了越来越多的关注。
特征选择是指从原始特征集合中筛选出一个规模更小、更有效的特征子集,使得模型在该子集上的性能能够达到或接近使用全部
原创力文档

文档评论(0)