- 1
- 0
- 约4.08千字
- 约 13页
- 2026-09-05 发布于福建
- 举报
第PAGE页共NUMPAGES页
2026年数据分析师技能进阶数据挖掘算法应用习题精讲
习题部分
一、单选题(每题2分,共10题)
1.在数据挖掘中,用于处理缺失值的方法不包括以下哪项?
A.回归填充
B.K最近邻填充
C.随机森林填充
D.直接删除缺失值
答案:D
解析:直接删除缺失值会导致数据丢失,降低样本量,可能影响模型效果。其他方法如回归填充、K最近邻填充和随机森林填充都是常用的处理缺失值技术。
2.在决策树算法中,选择分裂属性时常用的指标是?
A.信息增益率
B.Gini系数
C.基尼不纯度
D.以上都是
答案:D
解析:信息增益率和基尼不纯度都是决策树中常用的分裂属性选择指标,信息增益率是信息增益与属性熵的比值,基尼不纯度则衡量样本的不确定性。
3.在聚类算法中,K-Means算法的缺点不包括?
A.对初始聚类中心敏感
B.无法处理非凸形状的簇
C.对噪声数据敏感
D.计算效率高
答案:D
解析:K-Means算法的计算效率较高,但容易受到初始聚类中心和噪声数据的影响,且无法处理非凸形状的簇。
4.在关联规则挖掘中,常用的评估指标是?
A.提升度(Lift)
B.置信度(Confidence)
C.支持度(Support)
D.以上都是
答案:D
解析:提升度、置信度和支持度都是关联规则挖掘中的常用评估指标,
原创力文档

文档评论(0)