2026年数据挖掘与机器学习实战训练题库.docxVIP

  • 2
  • 0
  • 约1.03万字
  • 约 26页
  • 2026-10-01 发布于广东
  • 举报

2026年数据挖掘与机器学习实战训练题库.docx

2026年数据挖掘与机器学习实战训练题库

一、单项选择题(本大题共10小题,每小题2分,共20分)

1.在数据挖掘过程中,用于评估模型泛化能力的指标是()

A.过拟合度

B.训练误差

C.测试误差

D.特征冗余度

解析:本题考查模型评估基础概念。泛化能力指模型对未见过数据的预测性能,测试误差(C)最能反映泛化能力。过拟合度(A)是过拟合程度量化指标;训练误差(B)反映模型对训练数据的拟合程度;特征冗余度(D)指特征间的线性相关性,与模型泛化能力无直接关系。数据挖掘中常用留一法、交叉验证等方法评估测试误差。

2.决策树算法中,用于选择分裂属性的标准包括()

A.基尼系数与信息增益

B.决策规则与置信度提升

C.特征方差与相关系数

D.聚类系数与轮廓系数

解析:本题考查决策树分裂标准。分类决策树常用基尼系数(Giniimpurity)或信息增益(Informationgain)作为分裂标准。置信度提升(B)是关联规则挖掘指标;特征方差(C)用于特征选择;聚类系数(D)用于评估聚类效果。选项A正确,基尼系数适用于分类任务,信息增益适用于决策树分裂。

3.支持向量机(SVM)中,影响超平面间隔的主要参数是()

A.核函数参数

B.正则化系数C

文档评论(0)

1亿VIP精品文档

相关文档