2026年数据分析师技能进阶数据挖掘算法应用习题精讲.docxVIP

  • 1
  • 0
  • 约4.08千字
  • 约 13页
  • 2026-09-05 发布于福建
  • 举报

2026年数据分析师技能进阶数据挖掘算法应用习题精讲.docx

第PAGE页共NUMPAGES页

2026年数据分析师技能进阶数据挖掘算法应用习题精讲

习题部分

一、单选题(每题2分,共10题)

1.在数据挖掘中,用于处理缺失值的方法不包括以下哪项?

A.回归填充

B.K最近邻填充

C.随机森林填充

D.直接删除缺失值

答案:D

解析:直接删除缺失值会导致数据丢失,降低样本量,可能影响模型效果。其他方法如回归填充、K最近邻填充和随机森林填充都是常用的处理缺失值技术。

2.在决策树算法中,选择分裂属性时常用的指标是?

A.信息增益率

B.Gini系数

C.基尼不纯度

D.以上都是

答案:D

解析:信息增益率和基尼不纯度都是决策树中常用的分裂属性选择指标,信息增益率是信息增益与属性熵的比值,基尼不纯度则衡量样本的不确定性。

3.在聚类算法中,K-Means算法的缺点不包括?

A.对初始聚类中心敏感

B.无法处理非凸形状的簇

C.对噪声数据敏感

D.计算效率高

答案:D

解析:K-Means算法的计算效率较高,但容易受到初始聚类中心和噪声数据的影响,且无法处理非凸形状的簇。

4.在关联规则挖掘中,常用的评估指标是?

A.提升度(Lift)

B.置信度(Confidence)

C.支持度(Support)

D.以上都是

答案:D

解析:提升度、置信度和支持度都是关联规则挖掘中的常用评估指标,

文档评论(0)

1亿VIP精品文档

相关文档