2025-2026年大数据挖掘与可视化实战习题.docxVIP

  • 1
  • 0
  • 约5.34千字
  • 约 12页
  • 2026-09-17 发布于山东
  • 举报

2025-2026年大数据挖掘与可视化实战习题.docx

2025-2026年大数据挖掘与可视化实战习题

一、单选题(本大题共10小题,每小题2分,共20分)

1.在大数据挖掘的预处理阶段,对于缺失值处理方法中,以下哪种方法最常用于连续型数值特征?()

A.使用全局平均值填充

B.使用众数填充

C.使用随机森林预测填充

D.直接删除含有缺失值的样本

解析:连续型数值特征最适合的缺失值处理方法是C选项,随机森林预测填充能够基于其他特征预测缺失值,保持数据分布特性。A选项的全局平均值对异常值敏感,B选项的众数不适用于连续型数据,D选项的删除会导致数据量显著减少。

2.以下哪种算法属于监督学习算法?()

A.K-means聚类算法

B.决策树分类算法

C.主成分分析算法

D.Apriori关联规则算法

解析:决策树分类算法是典型的监督学习算法,需要训练数据带有标签。K-means属于无监督聚类算法,主成分分析是降维方法,Apriori是关联规则挖掘算法,均属于无监督或规则学习方法。

3.在数据可视化中,散点图最适合展示以下哪种关系?()

A.类别数据与数值数据的关系

B.两个连续型数值变量之间的相关性

C.时间序列数据的变化趋势

D.多个维度数据的分布情况

解析:散点图主要用于展示两个连续型数值变量之间的关系,通过点的分

文档评论(0)

1亿VIP精品文档

相关文档