- 2
- 0
- 约1.03万字
- 约 26页
- 2026-10-01 发布于广东
- 举报
2026年数据挖掘与机器学习实战训练题库
一、单项选择题(本大题共10小题,每小题2分,共20分)
1.在数据挖掘过程中,用于评估模型泛化能力的指标是()
A.过拟合度
B.训练误差
C.测试误差
D.特征冗余度
解析:本题考查模型评估基础概念。泛化能力指模型对未见过数据的预测性能,测试误差(C)最能反映泛化能力。过拟合度(A)是过拟合程度量化指标;训练误差(B)反映模型对训练数据的拟合程度;特征冗余度(D)指特征间的线性相关性,与模型泛化能力无直接关系。数据挖掘中常用留一法、交叉验证等方法评估测试误差。
2.决策树算法中,用于选择分裂属性的标准包括()
A.基尼系数与信息增益
B.决策规则与置信度提升
C.特征方差与相关系数
D.聚类系数与轮廓系数
解析:本题考查决策树分裂标准。分类决策树常用基尼系数(Giniimpurity)或信息增益(Informationgain)作为分裂标准。置信度提升(B)是关联规则挖掘指标;特征方差(C)用于特征选择;聚类系数(D)用于评估聚类效果。选项A正确,基尼系数适用于分类任务,信息增益适用于决策树分裂。
3.支持向量机(SVM)中,影响超平面间隔的主要参数是()
A.核函数参数
B.正则化系数C
原创力文档

文档评论(0)