- 2
- 0
- 约1.11万字
- 约 34页
- 2026-10-05 发布于山西
- 举报
2026年数据挖掘与数据科学综合测试卷
一、单项选择题(本大题共10小题,每小题2分,共20分)
1.在数据挖掘过程中,用于评估模型泛化能力的指标是()
A.过拟合度
B.训练误差
C.测试误差
D.特征冗余度
解析:正确答案为C。训练误差反映模型对训练数据的拟合程度,而测试误差才是衡量模型泛化能力的指标。过拟合度(A)是衡量模型对训练数据过度拟合的程度,特征冗余度(D)指特征之间的相关性程度。数据挖掘中模型评估的核心是区分学习偏差与方差,测试误差能有效反映模型在未知数据上的表现。
2.决策树算法中,用于选择分裂属性的标准不包括()
A.信息增益
B.基尼系数
C.互信息
D.相关系数
解析:正确答案为D。决策树常用的分裂标准包括信息增益(A)、基尼系数(B)和互信息(C),这些指标衡量分裂后数据纯度的提升程度。相关系数(D)是衡量两个变量线性相关性的统计量,主要用于特征选择而非分裂标准。
3.在聚类算法中,K-means算法的收敛条件是()
A.聚类中心不再变化
B.所有样本点到其所属中心距离最小
C.聚类数量达到预设值
D.轮次超过最大迭代次数
解析:正确答案为A。K-means算法通过迭代更新聚类中心,当
原创力文档

文档评论(0)